Innovazione

OpenAI svela Jalapeño: il chip per l’inferenza con prestazioni superiori

di admin Agosto 25, 2026
Chip Jalapeño di OpenAI

In Breve

Cosa è Jalapeño di OpenAI?
Jalapeño è un chip progettato per migliorare le prestazioni nell'inferenza, presentato da OpenAI alla conferenza Hot Chips.
Quali sono i vantaggi di Jalapeño?
Jalapeño offre un maggior numero di token per utente e una maggiore throughput per kilowatt rispetto ai processori attuali.
Quando sarà disponibile Jalapeño?
Il primo dispiegamento di Jalapeño è previsto entro la fine del 2026, con una distribuzione più ampia nel 2027.

Durante la conferenza Hot Chips, OpenAI ha svelato Jalapeño, il suo nuovo chip progettato per l’inferenza, che ha già mostrato risultati promettenti nei benchmark condotti da Semianalysis. Questi test evidenziano un aumento significativo nel numero di token elaborati per utente e una maggiore throughput per kilowatt rispetto ai processori di inferenza attualmente considerati all’avanguardia, come il sistema Nvidia Blackwell.

OpenAI ha sviluppato Jalapeño in collaborazione con Broadcom, integrando i propri modelli nel processo di progettazione. L’azienda prevede che questa piattaforma diventi multigenerazionale, in grado di coordinare chip, memoria e modelli in modo più efficiente. L’architettura del chip è stata progettata per minimizzare i ritardi nelle fasi di prefill e comunicazione, che tradizionalmente rappresentano colli di bottiglia durante il processo di inferenza. Come indicato nel comunicato ufficiale, “We designed Jalapeño to minimize data movement and communication delays.”

Un aspetto innovativo di Jalapeño è la sua capacità di allocare e mantenere localmente lo stato del modello, compresa la KV cache utilizzata durante la generazione delle risposte. Questo approccio permette al sistema di attivare la combinazione adeguata di calcolo, memoria e rete per ogni fase di inferenza, migliorando ulteriormente l’efficienza.

Richard Ho, responsabile hardware di OpenAI, ha commentato i risultati ottenuti: “The bottom line is that the results show a very, very significant performance advance over state of the art. Jalapeño can serve more AI work per unit of power, while also returning responses more quickly. It’s very efficient to serve a lot of customers, but it can also be very low latency.”

OpenAI prevede un primo dispiegamento di Jalapeño in volumi ridotti entro la fine del 2026, con una distribuzione più significativa attesa per il 2027. Questo sviluppo potrebbe rappresentare un punto di svolta nel settore dell’intelligenza artificiale, permettendo un servizio più rapido ed efficiente per un numero crescente di utenti.

Autore

admin

Leggi tutti gli articoli e gli approfondimenti firmati da questo autore.

Tutti gli articoli
Scorri per leggere il prossimo articolo