OpenAI dezvoltă cipul Jalapeño pentru a reduce costurile uriașe ale infrastructurii AI
Viitorul financiar al OpenAI depinde în mare măsură de reducerea cheltuielilor cu infrastructura, motiv pentru care compania a accelerat dezvoltarea propriului cip, denumit OpenAI Jalapeño. Proiectat în parteneriat cu Broadcom, noul circuit integrat de tip ASIC (Application-Specific Integrated Circuit) are rolul de a diminua dependența de procesoarele furnizate de alți producători și de a reduce costurile asociate operării modelelor de inteligență artificială.
În prezent, Nvidia obține marje de profit estimate la aproximativ 75% pentru cele mai performante cipuri destinate AI. În schimb, OpenAI păstrează doar în jur de 33 de cenți din fiecare dolar încasat, după acoperirea cheltuielilor uriașe necesare pentru funcționarea și dezvoltarea serviciilor sale.
Costurile de operare ale modelelor lingvistice de mari dimensiuni continuă să crească pe măsură ce utilizarea platformei se extinde. Anul trecut, menținerea infrastructurii necesare pentru funcționarea ChatGPT a generat cheltuieli de aproximativ 8,4 miliarde de dolari.
Odată cu atingerea pragului de 900 de milioane de utilizatori activi săptămânal, estimările indică faptul că aceste costuri ar putea urca la aproape 14 miliarde de dolari în acest an.
Pe termen lung, OpenAI pregătește investiții fără precedent în puterea de calcul necesară dezvoltării inteligenței artificiale. Compania și-a asumat cheltuieli totale estimate la 1,4 trilioane de dolari pentru infrastructură în următorii opt ani, o strategie ambițioasă pentru o companie care generează în prezent venituri anuale de aproximativ 25 de miliarde de dolari.
OpenAI Jalapeño, primul procesor AI creat special pentru modelele lingvistice de nouă generație
Noul cip OpenAI Jalapeño, prezentat de companie drept primul său „Intelligence Processor”, a fost proiectat exclusiv pentru rularea modelelor lingvistice de mari dimensiuni (LLM). Spre deosebire de acceleratoarele AI universale, acesta este optimizat pentru procesele de inferență – etapa în care modelele generează răspunsuri pentru utilizatori – și nu pentru sarcini generale de inteligență artificială.
OpenAI a conceput arhitectura procesorului pornind de la cerințele propriilor modele și ale infrastructurii ChatGPT, în timp ce Broadcom s-a ocupat de proiectarea cipului la nivel hardware și de integrarea tehnologiilor de comunicații de mare viteză.
Producția este realizată de compania taiwaneză TSMC, unul dintre cei mai mari producători de semiconductori din lume, iar Celestica dezvoltă plăcile electronice și sistemele rack în care vor fi instalate noile procesoare.
Potrivit OpenAI, primele mostre funcționale ale cipului rulează deja cu succes unele dintre cele mai avansate modele interne ale companiei, inclusiv o versiune încă neanunțată, denumită GPT-5.3-Codex-Spark, atingând nivelurile de performanță și consum energetic planificate pentru producția de serie.
Richard Ho, coordonatorul diviziei hardware din cadrul OpenAI, explică faptul că noua arhitectură a fost concepută pentru a reduce la minimum transferurile inutile de date între componente, ceea ce permite procesorului să funcționeze mult mai aproape de performanța sa teoretică maximă.
Spre deosebire de acceleratoarele AI tradiționale, adaptate din arhitecturi existente, Jalapeño echilibrează în mod special puterea de calcul, memoria și conexiunile de rețea pentru a elimina unul dintre cele mai mari obstacole în funcționarea modelelor lingvistice moderne: transferul rapid al volumelor uriașe de date între procesoare.
Pentru utilizarea în centre de date de mari dimensiuni, cipul integrează direct tehnologia de interconectare Broadcom Tomahawk, care permite comunicarea extrem de rapidă între mii de procesoare ce lucrează simultan în infrastructuri AI distribuite.
OpenAI intră în competiția marilor producători de cipuri AI și accelerează dezvoltarea procesorului Jalapeño
Prin lansarea propriului cip, OpenAI pătrunde într-un domeniu dominat până acum de giganți ai industriei tehnologice care investesc de ani buni în hardware dedicat inteligenței artificiale. Compania încearcă astfel să reducă dependența de furnizorii externi și să-și consolideze controlul asupra infrastructurii necesare dezvoltării viitoarelor modele AI.
Google a început dezvoltarea procesoarelor Tensor Processing Unit (TPU) încă din 2015, ajungând în prezent să dețină o parte importantă din capacitatea globală de calcul AI din afara ecosistemului Nvidia. În același timp, Amazon a livrat peste un milion de cipuri proprii, iar Meta și Microsoft își extind constant infrastructurile bazate pe hardware dezvoltat intern.
Greg Brockman, președinte și cofondator OpenAI, afirmă că procesorul Jalapeño reprezintă un element-cheie al strategiei pe termen lung a companiei de a controla întregul lanț tehnologic.
„Jalapeño face parte din strategia noastră de a construi o infrastructură completă, capabilă să ofere mai multă putere de calcul. Proiectând intern cât mai multe componente, putem furniza inteligență artificială la o scară mai mare și cu o eficiență superioară”, a declarat Brockman.
Pentru a recupera diferența față de concurență, OpenAI a accelerat semnificativ procesul de dezvoltare. Cipul Jalapeño a trecut de la faza de proiectare la etapa de tape-out – ultimul pas înainte de începerea producției fizice – în doar nouă luni, un interval considerat remarcabil pentru industria semiconductorilor.
Compania susține că această viteză a fost posibilă inclusiv datorită utilizării propriilor modele de inteligență artificială, care au automatizat și optimizat o parte dintre procesele de proiectare hardware.
Astfel, OpenAI creează un cerc tehnologic interesant: modelele AI folosite zilnic de utilizatori contribuie la dezvoltarea infrastructurii hardware pe care vor rula generațiile viitoare ale acelorași modele.
Primele implementări ale procesoarelor Jalapeño în centrele de date sunt programate să înceapă până la sfârșitul anului 2026. Totodată, directorul general al Broadcom, Hock Tan, a confirmat că extinderea va avea loc în colaborare cu partenerii de infrastructură ai OpenAI, inclusiv Microsoft, pentru construirea unor centre de date de dimensiuni foarte mari, proiectate să funcționeze la scară de gigawați.

