Sari la conținutul principal
OpenAI

25 august 2026

Companie

Infrastructura completă a inteligenței abundente

De Sarah Friar

Se încarcă…

Progresul în AI se amplifică cel mai rapid atunci când întregul sistem evoluează împreună. Așa privesc strategia OpenAI privind puterea de calcul: un sistem integrat care cuprinde centre de date și cipuri, modele de vârf, platforma noastră pentru dezvoltatori, produse pentru consumatori și companii și dispozitive create nativ pentru AI, fiecare nivel consolidându-l pe următorul.

Un software mai bun sporește productivitatea hardware-ului. Hardware-ul proiectat pentru sarcinile noastre de lucru îmbunătățește viteza și eficiența. Modelele mai capabile permit crearea unor produse mai bune, care generează mai multă cerere, utilizare și învățare. Aceste semnale revin în sistem și ne ajută să îl îmbunătățim din nou.

Astăzi, am prezentat primele rezultate măsurate privind performanța Jalapeño, primul cip de inferență personalizat al OpenAI. În InferenceX, un test comparativ public care utilizează GPT‑OSS 120B, Jalapeño a oferit un debit maxim mai mare per kilowatt și o latență mai redusă a tokenurilor decât sistemele comerciale incluse în comparație. De asemenea, a obținut rezultate foarte bune cu DeepSeek R1 și Kimi K2, demonstrând că avantajele sale se extind la mai multe familii de modele. 

Jalapeño își mărește avansul la cel mai bun TBT anterior

Jalapeño ne oferă mai mult control asupra modului în care rulează modelele noastre și asupra costurilor de operare a acestora. Dezvoltând împreună modelul, software-ul de operare, cipul, memoria și rețeaua, putem îmbunătăți randamentul, latența, eficiența energetică și costul ca un singur sistem. Astfel, creăm o alternativă proprie viabilă, alături de acceleratoarele celorlalți parteneri, și ne extindem capacitatea de a asocia fiecare sarcină de lucru cu sistemul optim, la costul potrivit. Dispunem acum de cipuri proprii funcționale, cu rezultate măsurate, iar generațiile viitoare sunt deja în curs de dezvoltare.

Construit pentru amploare, deținut pentru avantaj strategic

Sarcinile de lucru diferite impun sistemului cerințe diferite. Antrenarea modelelor de vârf, inferența la volum mare și agenții permanent activi au cerințe diferite în privința cipurilor, software-ului, rețelelor, energiei și latenței.

Obiectivul nostru este să rămânem pe frontiera Pareto: să căutăm permanent cea mai bună combinație de capabilitate, viteză, fiabilitate, eficiență și cost pentru fiecare sarcină de lucru. Cipurile și furnizorii diferiți excelează în domenii diferite, iar frontiera continuă să avanseze.

Portofoliul nostru ne oferă diversitatea necesară pentru a răspunde acestor cerințe. Puterea de calcul furnizată de Microsoft și cipurile NVIDIA au stat la baza creșterii OpenAI. Astăzi, portofoliul nostru include și AWS, AMD, Broadcom, Cerebras, CoreWeave, Oracle, SB Energy și SoftBank. Fiecare oferă avantaje diferite în infrastructura cloud, calculul accelerat, inferența cu latență redusă, dezvoltarea centrelor de date și furnizarea energiei.

Gestionăm activ acest portofoliu atât din perspectiva capabilităților, cât și a eficienței economice. Folosim sisteme premium acolo unde capabilitățile contează cel mai mult și optimizăm eficiența acolo unde scara și costurile sunt mai importante. Menținerea unor opțiuni viabile între furnizori, componente hardware și modele de implementare ne permite să direcționăm cererea către soluțiile cu cel mai bun raport performanță-preț, să păstrăm disciplina prețurilor pe măsură ce condițiile pieței se schimbă și să ținem pasul cu avangarda tehnologică pe măsură ce apar tehnologii mai performante. Controlul direct oferă un avantaj strategic acolo unde o integrare mai strânsă poate îmbunătăți întregul sistem. Colaborăm cu parteneri acolo unde ecosistemul ne ajută să avansăm mai rapid și dezvoltăm noi înșine acolo unde proiectarea în comun creează un avantaj semnificativ.

Centrele de date reprezintă un alt punct de avantaj strategic. Proiectul Camellia din Georgia arată cum putem proiecta facilități în funcție de sarcinile de lucru ale clienților, creând totodată locuri de muncă, sprijinind companiile locale, acoperind costurile infrastructurii și energiei aferente proiectului, economisind apă printr-un sistem cu circuit închis și supunând angajamentele asumate unui audit public independent anual.

Transformarea eficienței în valoare economică

Valoarea acestui sistem se măsoară prin ceea ce produce: mai multă inteligență utilă din fiecare unitate de calcul.

Modelele mai performante ajung la răspunsul corect din mai puține încercări. Rutarea și gestionarea mai inteligentă a contextului reduc munca inutilă. Software-ul optimizat și hardware-ul specializat îmbunătățesc viteza și eficiența energetică.

În Artificial Analysis Coding Agent Index, GPT‑5.6 Sol cu nivel maxim de raționament a atins un nou record, folosind cu 54% mai puține tokenuri de ieșire decât un alt model de top. Pentru clienți, astfel de îmbunătățiri înseamnă rezultate mai rapide, produse mai fiabile, mai puține reluări, agenți capabili să ducă la bun sfârșit fluxuri de lucru mai lungi și un cost total mai redus pentru sarcinile finalizate cu succes. Cea mai bună eficiență economică se obține din inteligența utilă oferită per dolar.

Pe măsură ce inteligența utilă devine mai capabilă și mai accesibilă, tot mai multe activități devin viabile economic. O companie poate oferi analize personalizate fiecărui client, poate verifica fiecare contract, poate simula în timp real scenarii financiare și îi poate ajuta pe ingineri să testeze mai multe idei. Acesta este paradoxul lui Jevons: eficiența sporită face ca mai multe utilizări să devină rentabile, extinzând consumul și generând activitate economică nouă prin mai multă muncă finalizată, decizii mai bune, mai multe produse lansate și venituri mai mari.

Un avantaj care se amplifică

O putere de calcul mai productivă și o bază de furnizori mai competitivă ne ajută să deservim mai mulți clienți la costuri mai mici și să transferăm aceste câștiguri de eficiență către utilizatori. Creșterea finanțează investițiile continue în cercetare, infrastructură și siguranță. Acesta este avantajul cumulativ al OpenAI: tehnologia mai bună generează o eficiență economică mai mare, aceasta finanțează următorul val de progres, iar fiecare îmbunătățire consolidează întregul sistem.

Autor

Sarah Friar