
OpenAI amplia la propria strategia infrastrutturale con Jalapeño, il primo chip OpenAI progettato per l’inferenza dei modelli linguistici di grandi dimensioni (LLM). L’azienda ha sviluppato il processore insieme a Broadcom e con il contributo di Celestica, con l’obiettivo di aumentare l’efficienza nell’esecuzione dei modelli di intelligenza artificiale e preparare una piattaforma hardware destinata ai futuri data center.
Il chip OpenAI punta a rendere più efficiente l’inferenza dei modelli AI
OpenAI ha progettato Jalapeño partendo dalle esigenze dei propri modelli linguistici e dei servizi che già utilizza, come ChatGPT, Codex, le API e i futuri prodotti basati su agenti AI. L’acceleratore nasce per l’inferenza, cioè la fase in cui un modello già addestrato elabora le richieste degli utenti e genera le risposte.
Secondo OpenAI, il chip è stato sviluppato per adattarsi anche ai futuri LLM dell’intero settore. L’azienda ha lavorato con Broadcom per la realizzazione del silicio e delle tecnologie di rete, mentre Celestica ha contribuito all’integrazione di schede, rack e sistemi destinati alla produzione su larga scala.
Campioni già operativi e primi risultati dei test
I campioni ingegneristici del processore eseguono già carichi di lavoro di machine learning nei laboratori di OpenAI alla frequenza e ai consumi previsti per la produzione, compresi workload basati su GPT-5.3-Codex-Spark. L’azienda sta ancora completando le misurazioni definitive delle prestazioni. I test preliminari indicano però una performance per watt superiore rispetto allo stato dell’arte. OpenAI ha precisato che pubblicherà un rapporto tecnico con i risultati completi nei prossimi mesi.
Sviluppo completato in nove mesi
OpenAI e Broadcom hanno completato il percorso che va dalla progettazione iniziale al tape-out – la fase in cui il progetto del chip viene inviato alla produzione – in nove mesi. Secondo le aziende, il programma ha utilizzato anche i modelli di OpenAI per accelerare alcune attività di progettazione e ottimizzazione del processore.
Il chip OpenAI rientra in una piattaforma hardware di lungo periodo
Jalapeño rappresenta il primo elemento di una piattaforma di calcolo multi-generazione che OpenAI intende sviluppare insieme ai partner industriali. La distribuzione iniziale è prevista entro la fine del 2026, con l’obiettivo di supportare data center su scala gigawatt attraverso più generazioni di acceleratori.
Per OpenAI, migliorare l’efficienza dell’inferenza significa aumentare la capacità di eseguire i modelli, ridurre il costo dell’elaborazione e offrire servizi più rapidi e affidabili a sviluppatori, imprese e utenti finali.






