Innovazione

OpenAI svela Jalapeño: il chip per inference che promette prestazioni superiori

Alla conferenza Hot Chips, OpenAI ha presentato Jalapeño, un chip progettato per migliorare le prestazioni nell'inference, superando i processori attuali.

In Breve

Cosa è Jalapeño?
Jalapeño è un chip sviluppato da OpenAI per ottimizzare le prestazioni nell'inference.
Quali sono i vantaggi di Jalapeño?
Offre un numero maggiore di token per utente e una throughput superiore per kilowatt rispetto ai processori attuali.
Quando sarà disponibile Jalapeño?
Il primo dispiegamento è previsto entro la fine del 2026, con una distribuzione più ampia nel 2027.

Durante la conferenza Hot Chips, OpenAI ha svelato Jalapeño, un chip innovativo progettato per ottimizzare le prestazioni nell’inference. I risultati preliminari dei benchmark condotti da InferenceX di Semianalysis indicano che Jalapeño offre un numero maggiore di token per utente e una throughput superiore per kilowatt rispetto ai processori di inference attualmente considerati all’avanguardia, come il sistema Nvidia Blackwell. Tuttavia, OpenAI avverte che la concorrenza potrebbe evolvere prima della piena distribuzione del prodotto.

Jalapeño è stato sviluppato in collaborazione con Broadcom e integra i modelli proprietari di OpenAI nel processo di progettazione. L’azienda prevede che questa piattaforma diventi multigenerazionale, coordinando chip, memoria e modelli per migliorare ulteriormente l’efficienza.

L’architettura di Jalapeño è stata progettata per ridurre i ritardi nelle fasi di prefill e comunicazione, che spesso rappresentano colli di bottiglia durante l’inference. Secondo il comunicato aziendale, “We designed Jalapeño to minimize data movement and communication delays”. Questo significa che lo stato del modello, inclusa la KV cache utilizzata durante la generazione delle risposte, può essere allocato e mantenuto localmente, ottimizzando la combinazione di calcolo, memoria e rete per ogni fase di inference.

Richard Ho, responsabile hardware di OpenAI, ha dichiarato: “The bottom line is that the results show a very, very significant performance advance over state of the art. Jalapeño can serve more AI work per unit of power, while also returning responses more quickly. It’s very efficient to serve a lot of customers, but it can also be very low latency.” Questa dichiarazione sottolinea l’efficienza del chip nel gestire un numero elevato di richieste senza compromettere la velocità di risposta.

OpenAI prevede un primo dispiegamento di Jalapeño in volumi molto ridotti entro la fine del 2026, con una distribuzione più significativa attesa per il 2027. Questo sviluppo rappresenta un passo importante nel campo dell’intelligenza artificiale, promettendo di trasformare il modo in cui le applicazioni AI gestiscono l’inference.

Autore

redazione

Leggi tutti gli articoli pubblicati da questo autore.

Tutti gli articoli
Iscriviti alla newsletter

Ricevi ogni giorno analisi, notizie e approfondimenti.