OpenAI و Broadcom از تراشه استنتاج بهینهشده برای الگوهای زبانی بزرگ (LLM) رونمایی کردند
- آزمایشهای اولیه نشان میدهد شتابدهنده نسل نخست، از نظر عملکرد بهازای هر وات، عملکردی بهمراتب بهتر از پیشرفتهترین راهکارهای موجود ارائه خواهد داد.
- از پایه برای الگوهای زبانی بزرگ (LLM) کنونی و آینده در سراسر صنعت ساخته شده است
- از طراحی تا تولید در نه ماه توسعه یافت و مدلهای OpenAI روند آن را شتاب دادند
- پلتفرم تمامپشته OpenAI را از محصولات تا مدلها و اکنون تا تراشهها گسترش میدهد
- قرار است با شرکای مرکز داده، در مقیاس گیگاوات و طی چند نسل بهکار گرفته شود
OpenAI و Broadcom (NASDAQ: AVGO) امروز از Jalapeño رونمایی کردند؛ نخستین «پردازنده هوش» OpenAI: شتابدهندهای که بر پایه چشمانداز OpenAI برای آینده استنتاج الگوهای زبانی بزرگ (LLM) طراحی شده و نخستین شتابدهنده AI در یک پلتفرم رایانشی چندنسلی است که این شرکتها با هم میسازند تا AI پیشرفته را سریعتر، قابلاعتمادتر و برای افراد بیشتری دسترسپذیرتر کنند.

Jalapeño از سوی هاک تن، رئیس و مدیرعامل Broadcom، و چارلی کاواس، رئیس Broadcom، به سم آلتمن، مدیرعامل OpenAI، و گرگ براکمن، رئیس OpenAI، تحویل داده شد؛ رویدادی که گامی مهم در راهبرد OpenAI برای ساخت کل پشته پشت مدلها و محصولاتش به شمار میآید.
OpenAI این تراشه را از پایه و بر اساس درک عمیق خود از مبانی مدلهای زبانی بزرگ (LLM) طراحی کرده است؛ درکی که از نقشه راه این شرکت برای توسعه مدلها، هستهها (kernels)، سامانههای ارائه سرویس (serving systems) و نیازهای محصولات شکل گرفته است. Broadcom و Celestica نیز با همکاری در طراحی و تولید تراشه، ساخت برد، یکپارچهسازی سامانههای رک، شبکههای پرکارایی و سامانههای تولید مقیاسپذیر، این پلتفرم را برای تولید صنعتی آماده کردهاند. Jalapeño بهگونهای طراحی شده است که با همه مدلهای زبانی بزرگ، بر پایه شناخت OpenAI از نیازهای استنتاج مدلهای هوش مصنوعی امروز و آینده، سازگار باشد. نمونههای مهندسی این تراشه هماکنون در آزمایشگاه با فرکانس و توان هدفِ تولید، بارهای کاری یادگیری ماشین، از جمله GPT‑5.3 Codex-Spark، را اجرا میکنند.
OpenAI هنوز در حال اندازهگیری عملکرد نهایی است، اما آزمایشهای اولیه نشان میدهد Jalapeño عملکرد بهازای هر وات را بسیار بهتر از بهترین فناوریهای کنونی ارائه خواهد کرد. گزارش فنی مفصلی درباره عملکرد در ماههای آینده ارائه خواهد شد. این معماری جابهجایی داده را کاهش میدهد و منابع رایانش، حافظه و شبکه را متوازن میکند تا بهرهبرداری عملی بسیار نزدیکتر به اوج عملکرد نظری حاصل شود. پیادهسازی سیلیکونی و فناوریهای شبکهسازی Broadcom، از جمله سیلیکون شبکه Tomahawk، به رساندن این پلتفرم به تولید در مقیاس بزرگ کمک میکند.
«جهان بهسوی اقتصادی مبتنی بر رایانش حرکت میکند»، گرگ براکمن، رئیس و همبنیانگذار OpenAI، گفت. «Jalapeño بخشی از راهبرد بلندمدت زیرساخت تمامپشته ماست تا رایانش را فراوانتر کنیم؛ نتیجه آن AI سریعتر، قابلاعتمادتر و مقرونبهصرفهتر برای مردم و کسبوکارهاست و میتواند برای حل مسائل مهمتری به کار رود. با طراحی بخشهای بیشتری از پشته به دست خودمان، میتوانیم هوش بیشتری را با کارایی بالاتر ارائه کنیم و همچنان AI پیشرفته را بهسوی دسترسی گستردهتر پیش ببریم.»
ریچارد هو، مدیر برنامه سختافزار OpenAI، گفت: «Jalapeño از پایه و بر اساس شناخت عمیقی طراحی شده است که از همکاری نزدیک ما با پژوهشگران OpenAI درباره استنتاج مدلهای زبانی بزرگ (LLM) به دست آمده است. معماری این تراشه را بر پایه عواملی بهینه کردهایم که بیشترین تأثیر را بر عملکرد مدلهای پیشرفته هوش مصنوعی دارند؛ از جمله هستهها (kernels)، جابهجایی داده در حافظه، شبکه و الگوهای ارائه سرویس (serving). نتایج اولیه نشان میدهد Jalapeño میتواند مهمترین بارهای کاری ما را با بهرهوری بالا و در سطحی نزدیک به سقف عملکرد نظری سختافزار اجرا کند.»
«همکاری ما با OpenAI نشاندهنده تعهدی بنیادین به مقیاسدادن زیرساخت فیزیکی لازم برای دهه آینده AI است»، هاک تن، رئیس و مدیرعامل Broadcom، گفت. «این تازه آغاز یک نقشه راه چندنسلی است. با توسعه مشترک سیلیکون پیشرو صنعتمان مستقیماً با OpenAI، استقرار مراکز داده در مقیاس گیگاوات را با Microsoft و دیگر شرکا از سال ۲۰۲۶ امکانپذیر میکنیم.»
Jalapeño از پایه برای استنتاج مدلهای زبانی بزرگ (LLM) طراحی شده است و برخلاف بسیاری از شتابدهندههای همهمنظوره، بر مبنای بارهای کاری پیشین هوش مصنوعی توسعه نیافته است. طراحی این تراشه بر پایه سامانههایی شکل گرفته که OpenAI هر روز برای ChatGPT، Codex، API و محصولات عاملمحور آینده خود به کار میگیرد و در عین حال بهگونهای طراحی شده است که از مدلهای زبانی بزرگ امروز و آینده در سراسر صنعت پشتیبانی کند. هدف این است که توان و توان عملیاتی شتابدهندههای پیشرفته هوش مصنوعی با تأخیر پایین سامانههای تخصصی استنتاج ترکیب شود تا Jalapeño گزینهای مناسب برای محصولات تعاملی مبتنی بر مدلهای زبانی بزرگ در مقیاس گسترده باشد.
این همان مزیت تمامپشته است. OpenAI فقط مدلهای پیشرو را توسعه نمیدهد یا محصولاتی بر پایه آنها نمیسازد؛ بلکه زیرساخت زیرین آنها را هم طراحی میکند: معماری تراشه، کرنلها، سامانههای حافظه، شبکهسازی، زمانبندی، سامانههای استقرار و تجربه محصول. از آنجا که OpenAI در سراسر پشته فعالیت میکند، هر لایه میتواند حول یک هدف واحد بهینه شود: سریعتر، قابلاعتمادتر و مقرونبهصرفهتر کردن مدلهایش برای کاربران.
Jalapeño چرخه محرک پیشرفت OpenAI را تقویت میکند. زیرساخت بهتر، کارایی رایانش را افزایش میدهد. کارایی بالاتر رایانش، آموزش و ارائه سرویس بهتر را ممکن میکند و در نهایت به مدلهای AI توانمندتری نیرو میدهد. مدلهای بهتر به محصولات بهتری برای مردم، توسعهدهندگان و کسبوکارها تبدیل میشوند. محصولات بهتر استفاده، مشتریان و درآمد بیشتری ایجاد میکنند و این به OpenAI امکان میدهد در نسل بعدی زیرساخت دوباره سرمایهگذاری کند. با گذشت زمان، این چرخه کمک میکند هوش برای همه توانمندتر، قابلاعتمادتر و کمهزینهتر شود.
Jalapeño از مرحله طراحی اولیه تا تکمیل فرایند tape-out تنها در ۹ ماه و با همکاری مشترک توسعه یافت. این برنامه شتابدهنده اختصاصی هوش مصنوعی نشان میدهد آنچه به باور ما سریعترین چرخه توسعه یک تراشه ASIC در حوزه نیمهرساناهای پیشرفته و پربازده است، دستیافتنی است. این سرعت حاصل همکاری عمیق میان نرمافزار و سختافزار، تخصص Broadcom در پیادهسازی سیلیکون و بهرهگیری از مدلهای OpenAI برای شتاب بخشیدن به بخشهایی از فرایند طراحی و بهینهسازی است.
همان مدلهایی که به کاربران ارائه میشوند، اکنون به بهبود زیرساختی کمک میکنند که برای اجرای مدلهای آینده به کار خواهد رفت. اگر AI بتواند به مهندسان کمک کند تراشههای بهتری را سریعتر طراحی کنند، میتواند هزینه رایانش را در سراسر صنعت کاهش دهد و به همگانیسازی دسترسی به AI پیشرفته کمک کند.
Jalapeño نخستین گام در مسیر ساخت یک پلتفرم محاسباتی چندنسلی است که قرار است تا پایان سال ۲۰۲۶ وارد مرحله استقرار اولیه شود و در سالهای بعد گسترش یابد. این پلتفرم، شتابدهندههای طراحیشده توسط OpenAI را با فناوریهای پیادهسازی سیلیکون، شبکه و اتصال Broadcom و همچنین تخصص Celestica در طراحی برد، سامانههای رک و یکپارچهسازی سیستمها ترکیب میکند.
هدف این کار ساده است: استنتاج جایی است که AI به مردم میرسد. هر بهبود در هزینه، سرعت و قابلیت اعتماد میتواند خود را به شکل پاسخ سریعتر ChatGPT، کاری در Codex که بتواند با انتظار کمتر گامهای بیشتری بردارد، محصول API ارزانتر برای ساخت، یا دسترسی قابلاتکاتر هنگام اوج تقاضا نشان دهد.
همگانیسازی AI یعنی مدلهای پیشرفته آنقدر در دسترس، قابلاتکا و مقرونبهصرفه باشند که افراد بیشتری بتوانند هر روز از آنها استفاده کنند. Jalapeño به OpenAI کمک میکند بخش بیشتری از زیرساخت خود را به هوشی مفید برای دانشجویان، توسعهدهندگان، کسبوکارهای کوچک، پژوهشگران، سازمانها و هر کسی که میخواهد یاد بگیرد، خلق کند یا مسائل دشوار را حل کند، تبدیل کند.


