OpenAI ja Broadcom esittelevät LLM-optimoidun päättelysirun
- Varhaiset testit osoittavat, että ensimmäisen sukupolven kiihdytin tarjoaa wattia kohti selvästi paremman suorituskyvyn kuin nykyiset huippuratkaisut
- Rakennettu alusta alkaen alan nykyisille ja tuleville suurille kielimalleille
- Kehitetty suunnittelusta tuotantoon yhdeksässä kuukaudessa OpenAI:n mallien vauhdittamana
- Laajentaa OpenAI:n koko pinon alustaa tuotteista malleihin ja nyt siruihin
- Otetaan käyttöön gigawattiluokan mittakaavassa datakeskuskumppanien kanssa useiden sukupolvien aikana
OpenAI ja Broadcom (NASDAQ: AVGO) esittelivät tänään Jalapeñon, OpenAI:n ensimmäisen Intelligence Processor -suorittimen: kiihdyttimen, joka on suunniteltu OpenAI:n näkemyksen pohjalta suurten kielimallien päättelyn tulevaisuudesta. Se on myös ensimmäinen AI-kiihdytin monen sukupolven laskenta-alustassa, jota yhtiöt rakentavat yhdessä tehdäkseen kehittyneestä AI:sta nopeampaa, luotettavampaa ja saavutettavampaa useammille ihmisille.

Broadcomin toimitusjohtaja Hock Tan ja johtaja Charlie Kawwas luovuttivat Jalapeñon OpenAI:n toimitusjohtajalle Sam Altmanille ja pääjohtaja Greg Brockmanille. Tämä on tärkeä askel OpenAI:n strategiassa rakentaa koko pino sen mallien ja tuotteiden taustalle.
OpenAI suunnitteli sirun alusta alkaen syvällisen suurten kielimallien perusteiden ymmärryksensä pohjalta. Suunnittelua ohjasivat sen mallien, ytimien, palvelujärjestelmien ja tuotetarpeiden etenemissuunnitelmat, ja kumppanit Broadcom ja Celestica auttoivat teollistamaan alustan sirutoteutuksen, korttien, kehikkojärjestelmien integroinnin, korkean suorituskyvyn verkotuksen ja skaalautuvien tuotantojärjestelmien kautta. Jalapeño on suunniteltu joustavaksi toimimaan kaikkien suurten kielimallien kanssa. Suunnittelua ohjaavat OpenAI:n näkemykset alan nykyisten ja tulevien AI-mallien päättelytarpeista. Jalapeño-sirun kehitysnäytteet ajavat laboratoriossa koneoppimiskuormia, myös GPT‑5.3‑Codex‑Sparkia, tuotannon tavoitetaajuudella ja -teholla.
Vaikka OpenAI mittaa vielä lopullista suorituskykyä, varhaiset testit osoittavat, että Jalapeño tarjoaa wattia kohti selvästi paremman suorituskyvyn kuin nykyiset huippuratkaisut. Yksityiskohtainen tekninen raportti suorituskyvystä esitellään tulevien kuukausien aikana. Arkkitehtuuri vähentää datan siirtelyä ja tasapainottaa laskennan, muistin ja verkkoresurssit, jotta toteutunut käyttöaste pääsee paljon lähemmäs teoreettista huippusuorituskykyä. Broadcomin piitoteutus ja verkkoteknologiat, mukaan lukien Tomahawk-verkkopii, auttavat viemään alustan laajamittaiseen tuotantoon.
”Maailma on siirtymässä laskentavoiman pyörittämään talouteen”, sanoi Greg Brockman, OpenAI:n pääjohtaja ja toinen perustaja. ”Jalapeño on osa pitkän aikavälin koko pinon infrastruktuuristrategiaamme, jonka tavoitteena on lisätä laskennan saatavuutta. Tuloksena on AI, joka on nopeampaa, luotettavampaa ja edullisempaa ihmisille ja yrityksille ja jota voidaan käyttää tärkeämpien ongelmien ratkaisemiseen. Kun suunnittelemme suuremman osan pinosta itse, voimme tarjota enemmän älykkyyttä tehokkaammin ja jatkaa kehittyneen AI:n viemistä yhä laajempaan käyttöön.”
”Jalapeño suunniteltiin alusta alkaen suurten kielimallien päättelyyn hyödyntäen yksityiskohtaista tietoa läheisestä yhteistyöstämme OpenAI:n tutkijoiden kanssa”, sanoi OpenAI:n laitteisto-ohjelmaa johtava Richard Ho. ”Optimoimme arkkitehtuurin ytimien, muistin siirtelyn, verkotuksen ja palvelumallien ympärille, jotka ovat tärkeimpiä huippuluokan AI-malleille. Varhaisten testien perusteella Jalapeño suorittaa tärkeimmät työkuormamme tehokkaasti lähellä laitteiston teoreettisia rajoja.”
”Yhteistyömme OpenAI:n kanssa on perustavanlaatuinen sitoumus skaalata fyysistä infrastruktuuria, jota seuraava AI-vuosikymmen edellyttää”, sanoi Hock Tan, Broadcomin toimitusjohtaja. ”Tämä on vasta alku monen sukupolven etenemissuunnitelmalle. Kehittämällä alan johtavaa piiteknologiaamme suoraan OpenAI:n kanssa mahdollistamme gigawattiluokan datakeskusten käyttöönoton Microsoftin ja muiden kumppanien kanssa vuodesta 2026 alkaen.”
Jalapeño on puhtaalta pöydältä suunniteltu ratkaisu nykyaikaiseen suurten kielimallien päättelyyn, ei aiemmista AI-työkuormista mukautettu yleiskäyttöinen kiihdytin. Sen taustalla ovat järjestelmät, joita OpenAI käyttää päivittäin ChatGPT:ssä, Codexissa, API:ssa ja tulevissa agenttipohjaisissa tuotteissa, mutta se on samalla suunniteltu alan nykyisille ja tuleville suurille kielimalleille. Tavoitteena on yhdistää nykyisten johtavien AI-kiihdyttimien teho ja suoritusteho viiveeseen, joka on lähempänä nopeimpia erikoistuneita päättelyjärjestelmiä. Siksi Jalapeño sopii hyvin vuorovaikutteisiin suurten kielimallien tuotteisiin laajassa mittakaavassa.
Siinä on koko pinon etu. OpenAI ei ainoastaan kehitä edistyneimpiä malleja tai rakenna tuotteita niiden päälle, vaan suunnittelee niiden alla olevan infrastruktuurin: siruarkkitehtuurin, ytimet, muistijärjestelmät, verkotuksen, ajoituksen, käyttöönottojärjestelmät ja tuotekokemuksen. Koska OpenAI toimii koko pinon alueella, jokainen kerros voidaan optimoida saman tavoitteen ympärille: tehdä sen malleista nopeampia, luotettavampia ja edullisempia käyttäjille.
Jalapeño vahvistaa OpenAI:n edistystä vauhdittavaa kehää. Parempi infrastruktuuri parantaa laskennan tehokkuutta. Parempi laskennan tehokkuus mahdollistaa paremman koulutuksen ja palvelun, mikä lopulta tuottaa kyvykkäämpiä AI-malleja. Paremmista malleista syntyy parempia tuotteita ihmisille, kehittäjille ja yrityksille. Paremmat tuotteet lisäävät käyttöä, asiakkaita ja liikevaihtoa, minkä ansiosta OpenAI voi investoida uudelleen seuraavan sukupolven infrastruktuuriin. Ajan myötä tämä kierto auttaa tekemään älykkyydestä kyvykkäämpää, luotettavampaa ja edullisempaa kaikille.
Jalapeño kehitettiin yhdessä alkuperäisestä suunnittelusta valmistuksen tape-out-vaiheeseen vain yhdeksässä kuukaudessa. Räätälöity AI-kiihdytinohjelma edustaa käsityksemme mukaan nopeinta koskaan saavutettua ASIC-kehityssykliä korkean suorituskyvyn edistyneissä puolijohteissa. Tämä nopeus kertoo syvästä ohjelmiston ja laitteiston yhteiskehityksestä OpenAI:n insinööritiimien kanssa, Broadcomin piitoteutuksen asiantuntemuksesta sekä OpenAI:n mallien käytöstä suunnittelu- ja optimointiprosessin osien vauhdittamiseen.
Samat mallit, joita tarjotaan käyttäjille, auttavat parantamaan infrastruktuuria, jolla tulevia malleja ajetaan. Jos AI voi auttaa insinöörejä suunnittelemaan parempia siruja nopeammin, se voi alentaa laskennan kustannuksia koko alalla ja auttaa demokratisoimaan pääsyn kehittyneeseen AI:hin.
Jalapeño on ensimmäinen askel monen sukupolven laskenta-alustassa, jonka ensimmäinen käyttöönotto on suunniteltu vuoden 2026 loppuun mennessä ja jonka on tarkoitus laajentua tulevina vuosina. Se yhdistää OpenAI:n suunnittelemat kiihdyttimet Broadcomin piitoteutukseen, verkotus- ja liitettävyysteknologioihin sekä Celestican kortti-, kehikko- ja järjestelmäosaamiseen.
Työn tarkoitus on yksinkertainen: päättely on kohta, jossa AI tavoittaa ihmiset. Jokainen parannus kustannuksissa, nopeudessa ja luotettavuudessa voi näkyä nopeampana ChatGPT‑vastauksena, Codex-tehtävänä, joka voi edetä useamman vaiheen vähemmällä odottamisella, API-tuotteena, jonka rakentaminen on halvempaa, tai luotettavampana saatavuutena suuren kysynnän aikana.
AI:n demokratisointi tarkoittaa, että kehittyneistä malleista tehdään riittävän saatavilla olevia, luotettavia ja edullisia, jotta useammat ihmiset voivat käyttää niitä joka päivä. Jalapeño auttaa OpenAI:ta muuttamaan yhä suuremman osan infrastruktuuristaan hyödylliseksi älykkyydeksi opiskelijoille, kehittäjille, pienyrityksille, tutkijoille, suuryrityksille ja kaikille, jotka yrittävät oppia, luoda tai ratkaista vaikeita ongelmia.


