پرش به محتوای اصلی
OpenAI

۳ تیر ۱۴۰۵

شرکت

OpenAI و Broadcom از تراشه استنتاج بهینه‌شده برای الگوهای زبانی بزرگ (LLM) رونمایی کردند

در حال بارگذاری…
  • آزمایش‌های اولیه نشان می‌دهد شتاب‌دهنده نسل نخست، از نظر عملکرد به‌ازای هر وات، عملکردی به‌مراتب بهتر از پیشرفته‌ترین راهکارهای موجود ارائه خواهد داد.
  • از پایه برای الگوهای زبانی بزرگ (LLM) کنونی و آینده در سراسر صنعت ساخته شده است
  • از طراحی تا تولید در نه ماه توسعه یافت و مدل‌های OpenAI روند آن را شتاب دادند
  • پلتفرم تمام‌پشته OpenAI را از محصولات تا مدل‌ها و اکنون تا تراشه‌ها گسترش می‌دهد
  • قرار است با شرکای مرکز داده، در مقیاس گیگاوات و طی چند نسل به‌کار گرفته شود

OpenAI و Broadcom (NASDAQ: AVGO) امروز از Jalapeño رونمایی کردند؛ نخستین «پردازنده هوش» OpenAI: شتاب‌دهنده‌ای که بر پایه چشم‌انداز OpenAI برای آینده استنتاج الگوهای زبانی بزرگ (LLM) طراحی شده و نخستین شتاب‌دهنده AI در یک پلتفرم رایانشی چندنسلی است که این شرکت‌ها با هم می‌سازند تا AI پیشرفته را سریع‌تر، قابل‌اعتمادتر و برای افراد بیشتری دسترس‌پذیرتر کنند.

رهبران OpenAI و Broadcom تراشه استنتاج Jalapeño را نمایش می‌دهند.

Jalapeño از سوی هاک تن، رئیس و مدیرعامل Broadcom، و چارلی کاواس، رئیس Broadcom، به سم آلتمن، مدیرعامل OpenAI، و گرگ براکمن، رئیس OpenAI، تحویل داده شد؛ رویدادی که گامی مهم در راهبرد OpenAI برای ساخت کل پشته پشت مدل‌ها و محصولاتش به شمار می‌آید.

OpenAI این تراشه را از پایه و بر اساس درک عمیق خود از مبانی مدل‌های زبانی بزرگ (LLM) طراحی کرده است؛ درکی که از نقشه راه این شرکت برای توسعه مدل‌ها، هسته‌ها (kernels)، سامانه‌های ارائه سرویس (serving systems) و نیازهای محصولات شکل گرفته است. Broadcom و Celestica نیز با همکاری در طراحی و تولید تراشه، ساخت برد، یکپارچه‌سازی سامانه‌های رک، شبکه‌های پرکارایی و سامانه‌های تولید مقیاس‌پذیر، این پلتفرم را برای تولید صنعتی آماده کرده‌اند. Jalapeño به‌گونه‌ای طراحی شده است که با همه مدل‌های زبانی بزرگ، بر پایه شناخت OpenAI از نیازهای استنتاج مدل‌های هوش مصنوعی امروز و آینده، سازگار باشد. نمونه‌های مهندسی این تراشه هم‌اکنون در آزمایشگاه با فرکانس و توان هدفِ تولید، بارهای کاری یادگیری ماشین، از جمله GPT‑5.3 Codex-Spark، را اجرا می‌کنند.

OpenAI هنوز در حال اندازه‌گیری عملکرد نهایی است، اما آزمایش‌های اولیه نشان می‌دهد Jalapeño عملکرد به‌ازای هر وات را بسیار بهتر از بهترین فناوری‌های کنونی ارائه خواهد کرد. گزارش فنی مفصلی درباره عملکرد در ماه‌های آینده ارائه خواهد شد. این معماری جابه‌جایی داده را کاهش می‌دهد و منابع رایانش، حافظه و شبکه را متوازن می‌کند تا بهره‌برداری عملی بسیار نزدیک‌تر به اوج عملکرد نظری حاصل شود. پیاده‌سازی سیلیکونی و فناوری‌های شبکه‌سازی Broadcom، از جمله سیلیکون شبکه Tomahawk، به رساندن این پلتفرم به تولید در مقیاس بزرگ کمک می‌کند.

«جهان به‌سوی اقتصادی مبتنی بر رایانش حرکت می‌کند»، گرگ براکمن، رئیس و هم‌بنیان‌گذار OpenAI، گفت. «Jalapeño بخشی از راهبرد بلندمدت زیرساخت تمام‌پشته ماست تا رایانش را فراوان‌تر کنیم؛ نتیجه آن AI سریع‌تر، قابل‌اعتمادتر و مقرون‌به‌صرفه‌تر برای مردم و کسب‌وکارهاست و می‌تواند برای حل مسائل مهم‌تری به کار رود. با طراحی بخش‌های بیشتری از پشته به دست خودمان، می‌توانیم هوش بیشتری را با کارایی بالاتر ارائه کنیم و همچنان AI پیشرفته را به‌سوی دسترسی گسترده‌تر پیش ببریم.»

ریچارد هو، مدیر برنامه سخت‌افزار OpenAI، گفت: «Jalapeño از پایه و بر اساس شناخت عمیقی طراحی شده است که از همکاری نزدیک ما با پژوهشگران OpenAI درباره استنتاج مدل‌های زبانی بزرگ (LLM) به دست آمده است. معماری این تراشه را بر پایه عواملی بهینه کرده‌ایم که بیشترین تأثیر را بر عملکرد مدل‌های پیشرفته هوش مصنوعی دارند؛ از جمله هسته‌ها (kernels)، جابه‌جایی داده در حافظه، شبکه و الگوهای ارائه سرویس (serving). نتایج اولیه نشان می‌دهد Jalapeño می‌تواند مهم‌ترین بارهای کاری ما را با بهره‌وری بالا و در سطحی نزدیک به سقف عملکرد نظری سخت‌افزار اجرا کند.»

«همکاری ما با OpenAI نشان‌دهنده تعهدی بنیادین به مقیاس‌دادن زیرساخت فیزیکی لازم برای دهه آینده AI است»، هاک تن، رئیس و مدیرعامل Broadcom، گفت. «این تازه آغاز یک نقشه راه چندنسلی است. با توسعه مشترک سیلیکون پیشرو صنعت‌مان مستقیماً با OpenAI، استقرار مراکز داده در مقیاس گیگاوات را با Microsoft و دیگر شرکا از سال ۲۰۲۶ امکان‌پذیر می‌کنیم.»

طراحی‌شده برای اینکه بهترین پلتفرم استنتاج برای الگوهای زبانی بزرگ (LLM) باشد

Jalapeño از پایه برای استنتاج مدل‌های زبانی بزرگ (LLM) طراحی شده است و برخلاف بسیاری از شتاب‌دهنده‌های همه‌منظوره، بر مبنای بارهای کاری پیشین هوش مصنوعی توسعه نیافته است. طراحی این تراشه بر پایه سامانه‌هایی شکل گرفته که OpenAI هر روز برای ChatGPT، Codex، API و محصولات عامل‌محور آینده خود به کار می‌گیرد و در عین حال به‌گونه‌ای طراحی شده است که از مدل‌های زبانی بزرگ امروز و آینده در سراسر صنعت پشتیبانی کند. هدف این است که توان و توان عملیاتی شتاب‌دهنده‌های پیشرفته هوش مصنوعی با تأخیر پایین سامانه‌های تخصصی استنتاج ترکیب شود تا Jalapeño گزینه‌ای مناسب برای محصولات تعاملی مبتنی بر مدل‌های زبانی بزرگ در مقیاس گسترده باشد.

این همان مزیت تمام‌پشته است. OpenAI فقط مدل‌های پیشرو را توسعه نمی‌دهد یا محصولاتی بر پایه آن‌ها نمی‌سازد؛ بلکه زیرساخت زیرین آن‌ها را هم طراحی می‌کند: معماری تراشه، کرنل‌ها، سامانه‌های حافظه، شبکه‌سازی، زمان‌بندی، سامانه‌های استقرار و تجربه محصول. از آنجا که OpenAI در سراسر پشته فعالیت می‌کند، هر لایه می‌تواند حول یک هدف واحد بهینه شود: سریع‌تر، قابل‌اعتمادتر و مقرون‌به‌صرفه‌تر کردن مدل‌هایش برای کاربران.

Jalapeño چرخه محرک پیشرفت OpenAI را تقویت می‌کند. زیرساخت بهتر، کارایی رایانش را افزایش می‌دهد. کارایی بالاتر رایانش، آموزش و ارائه سرویس بهتر را ممکن می‌کند و در نهایت به مدل‌های AI توانمندتری نیرو می‌دهد. مدل‌های بهتر به محصولات بهتری برای مردم، توسعه‌دهندگان و کسب‌وکارها تبدیل می‌شوند. محصولات بهتر استفاده، مشتریان و درآمد بیشتری ایجاد می‌کنند و این به OpenAI امکان می‌دهد در نسل بعدی زیرساخت دوباره سرمایه‌گذاری کند. با گذشت زمان، این چرخه کمک می‌کند هوش برای همه توانمندتر، قابل‌اعتمادتر و کم‌هزینه‌تر شود.

تیپ‌اوت نه‌ماهه، با شتاب‌گیری از مدل‌های OpenAI

Jalapeño از مرحله طراحی اولیه تا تکمیل فرایند tape-out تنها در ۹ ماه و با همکاری مشترک توسعه یافت. این برنامه شتاب‌دهنده اختصاصی هوش مصنوعی نشان می‌دهد آنچه به باور ما سریع‌ترین چرخه توسعه یک تراشه ASIC در حوزه نیمه‌رساناهای پیشرفته و پربازده است، دست‌یافتنی است. این سرعت حاصل همکاری عمیق میان نرم‌افزار و سخت‌افزار، تخصص Broadcom در پیاده‌سازی سیلیکون و بهره‌گیری از مدل‌های OpenAI برای شتاب بخشیدن به بخش‌هایی از فرایند طراحی و بهینه‌سازی است.

همان مدل‌هایی که به کاربران ارائه می‌شوند، اکنون به بهبود زیرساختی کمک می‌کنند که برای اجرای مدل‌های آینده به کار خواهد رفت. اگر AI بتواند به مهندسان کمک کند تراشه‌های بهتری را سریع‌تر طراحی کنند، می‌تواند هزینه رایانش را در سراسر صنعت کاهش دهد و به همگانی‌سازی دسترسی به AI پیشرفته کمک کند.

ساخت یک پلتفرم چندنسلی با شرکا

Jalapeño نخستین گام در مسیر ساخت یک پلتفرم محاسباتی چندنسلی است که قرار است تا پایان سال ۲۰۲۶ وارد مرحله استقرار اولیه شود و در سال‌های بعد گسترش یابد. این پلتفرم، شتاب‌دهنده‌های طراحی‌شده توسط OpenAI را با فناوری‌های پیاده‌سازی سیلیکون، شبکه و اتصال Broadcom و همچنین تخصص Celestica در طراحی برد، سامانه‌های رک و یکپارچه‌سازی سیستم‌ها ترکیب می‌کند.

دسترس‌پذیرتر کردن AI پیشرفته برای همگان

هدف این کار ساده است: استنتاج جایی است که AI به مردم می‌رسد. هر بهبود در هزینه، سرعت و قابلیت اعتماد می‌تواند خود را به شکل پاسخ سریع‌تر ChatGPT، کاری در Codex که بتواند با انتظار کمتر گام‌های بیشتری بردارد، محصول API ارزان‌تر برای ساخت، یا دسترسی قابل‌اتکاتر هنگام اوج تقاضا نشان دهد.

همگانی‌سازی AI یعنی مدل‌های پیشرفته آن‌قدر در دسترس، قابل‌اتکا و مقرون‌به‌صرفه باشند که افراد بیشتری بتوانند هر روز از آن‌ها استفاده کنند. Jalapeño به OpenAI کمک می‌کند بخش بیشتری از زیرساخت خود را به هوشی مفید برای دانشجویان، توسعه‌دهندگان، کسب‌وکارهای کوچک، پژوهشگران، سازمان‌ها و هر کسی که می‌خواهد یاد بگیرد، خلق کند یا مسائل دشوار را حل کند، تبدیل کند.

نویسنده

OpenAI