پرش به محتوای اصلی
OpenAI

۸ مرداد ۱۴۰۵

محصول

پیشبرد مرز قیمت‌ـ‌عملکرد با GPT‑5.6

OpenAI با کارآمدتر کردن تمام لایه‌ها، به‌ازای هر دلار عملکرد بهتری را در طیف گسترده‌تری از بارهای کاری سازمانی ارائه می‌دهد.

در حال بارگذاری…

دیروز توضیح دادیم که GPT‑5.6 چگونه به اجرای کارآمدتر خود کمک کرده است. امروز این دستاوردها را با کاهش قیمت GPT‑5.6 Luna(در یک پنجره جدید باز می‌شود) و Terra(در یک پنجره جدید باز می‌شود) و افزایش سرعت GPT‑5.6 Sol در API در اختیار مشتریان می‌گذاریم. این به‌روزرسانی‌ها در کنار هم کمک می‌کنند مشتریان از هر دلاری که در هوش مصنوعی سرمایه‌گذاری می‌کنند بهره بیشتری ببرند و هرگاه زمان اهمیت دارد، سریع‌تر پیش بروند.

از امروز، هزینه GPT‑5.6 Luna، سریع‌ترین و مقرون‌به‌صرفه‌ترین مدل ما، ۸۰٪ و هزینه GPT‑5.6 Terra، مدل متعادل ما برای کارهای روزمره، ۲۰٪ کاهش می‌یابد. این کاهش قیمت Luna و Terra در نحوه محاسبه مصرف اشتراک‌های پولی هنگام استفاده از Codex و ChatGPT Work نیز اعمال می‌شود. Luna راهی بسیار مقرون‌به‌صرفه‌تر در اختیار کسب‌وکارها می‌گذارد تا حجم بالای کار را با کیفیتی بسیار بالا انجام دهند. این مدل می‌تواند از ابزارها استفاده کند و گردش‌های کاری چندمرحله‌ای را به پایان برساند؛ در نتیجه اجرای طیف گسترده‌تری از کاربردهای هوش مصنوعی در مقیاس بالا عملی می‌شود.

فراوان‌تر و مقرون‌به‌صرفه‌تر کردن هوشمندی پیشرفته، محور مأموریت OpenAI برای تضمین بهره‌مندی همه بشریت از AGI است. این تغییرات، آن تعهد را به عمل تبدیل می‌کنند. این تغییرات حاصل سال‌ها بهبود در شیوه ساخت، ارائه و به‌کارگیری مدل‌های ما هستند.

همچنین حالت سریع را در API معرفی می‌کنیم که جایگزین سرویس Priority Processing ما می‌شود. حالت سریع برای GPT‑5.6 Sol اکنون با دو برابر قیمت، سرعتی تا ۲٫۵ برابر بیشتر از پردازش Standard ارائه می‌دهد، بی‌آنکه هوشمندی تغییر کند. حالت سریع با نسخه‌های قبلی سازگار است: درخواست‌های دارای برچسب priority به‌طور خودکار از حالت سریع استفاده می‌کنند.

1 از 6
GPT‑5.6 Luna نزدیک‌ترین چیزی است که تاکنون به هوشمندیِ آن‌قدر ارزان که سنجش مصرفش بی‌معنا باشد رسیده‌ایم. هرگز مدلی با این قیمت مناسب و چنین قدرتی ندیده‌ام؛ این مدل کاربردهایی را برای Replit ممکن می‌کند که انتظار نداشتیم تا مدت‌ها بتوانیم برایشان محصول بسازیم.
میکله کاتاستا، رئیس و مدیر هوش مصنوعی Replit

تطبیق هوشمندی با نتیجه مطلوب

استفاده کارآمد از هوش مصنوعی با نتیجه مطلوب آغاز می‌شود. اهمیت کار، هزینه خطا، فوریت و مقیاس، تعادل مناسب میان هوشمندی، سرعت، قابلیت اطمینان و هزینه را تعیین می‌کنند. این تعادل ممکن است از مرحله‌ای به مرحله دیگر گردش کار تغییر کند.

GPT‑5.6 فضای بسیار بیشتری برای بهینه‌سازی این معادله در اختیار کسب‌وکارها می‌گذارد. Luna با هزینه‌ای حدود ۶ سنت به‌ازای هر دلار برای هر وظیفه و سرعتی نزدیک به ۹ برابر، عملکردی هم‌سطح مدل‌هایی ارائه می‌دهد که یک سال پیش در رده پیشرو بودند. در کارهای حرفه‌ای و بر اساس معیار «آخرین آزمون عامل‌ها»، Luna با هزینه تخمینی هر وظیفه که نزدیک به ۹۹٪ کمتر است، از Fable 5 بهتر عمل می‌کند.

در عمل، کسب‌وکارها می‌توانند نتیجه و معیار کیفیت موردنیازشان را تعریف کنند و سپس با ارزیابی مشخص کنند هوشمندی بیشتر در کجا نتیجه را به‌طور محسوسی بهبود می‌دهد و پردازش سریع‌تر و کم‌هزینه‌تر در کجا همان کیفیت را فراهم می‌کند. برای نمونه، یک گردش کار کدنویسی می‌تواند از Sol برای رفع ابهام و تدوین برنامه استفاده کند و سپس با Luna تغییرات دقیقاً مشخص‌شده را پیاده‌سازی کند، آزمون‌ها را بنویسد و اجرا کند و نتایج را بسنجد. گردش کاری دیگر ممکن است به تعادل متفاوتی نیاز داشته باشد.

خانواده GPT‑5.6 دامنه این انتخاب‌ها را گسترش می‌دهد. کسب‌وکارها می‌توانند در هر مرحله از بیشترین هوشمندی مفید بهره بگیرند و متناسب با ارزشی که ایجاد می‌شود هزینه بپردازند.

فراهم کردن این انعطاف‌پذیری با کارآمدتر کردن تمام لایه‌های پشتیبان مدل‌ها آغاز می‌شود.

چگونه مرز بهره‌وری را پیش می‌بریم

برتری ما در بهره‌وری از بهبود مدل‌ها، سامانه‌های استنتاجی که آن‌ها را اجرا می‌کنند و چارچوب آزمون عامل‌محوری ناشی می‌شود که آن‌ها را به ابزارها و زمینه متصل می‌کند. مدل‌های GPT‑5.6 مسیر مستقیم‌تری را برای انجام کار طی می‌کنند. مسیریابی بهتر، سخت‌افزار را پربازده نگه می‌دارد؛ نرم‌افزار تولیدی بهینه‌شده، توکن‌ها را کارآمدتر تولید می‌کند؛ و مدیریت هوشمندتر زمینه به عامل‌ها کمک می‌کند کارهای تکمیل‌شده را تکرار نکنند. این بهبودها در کنار هم به ما امکان می‌دهند با توان پردازشی یکسان، کار مفید بیشتری انجام دهیم و زمان، توکن و هزینه لازم برای هر نتیجه را کاهش دهیم.

GPT‑5.6 Sol بیش‌ازپیش به ما کمک می‌کند دور بعدی بهبودها را شناسایی و ارائه کنیم. Sol در فرایندی با هدایت انسان، کرنل‌های عملیاتی را به‌طور مستقل بازنویسی و بهینه کرد، صدها آزمایش برای بهبود تولید توکن طراحی و اجرا کرد و آموزش را زیر نظر گرفت و هنگام بروز مشکل مداخله کرد. کار روی کرنل‌ها هزینه سرتاسری ارائه مدل را ۲۰٪ کاهش داد و آزمایش‌های آن نیز بهره‌وری تولید توکن را بیش از ۱۵٪ افزایش داد. این کار ادامه دارد و چرخه بازخورد فشرده‌تری ایجاد می‌کند: هرچه مدل‌های ما بهتر و قادر به کار مستقل‌تر شوند، سرعت افزایش بهره‌وری ما نیز بیشتر می‌شود. درباره مهندسی زیربنای GPT‑5.6 بیشتر بخوانید.

راهبرد توان پردازشی ساخته‌شده برای مقیاس‌پذیری

پاسخ‌گویی به تقاضا برای هوشمندی فراوان، هم به توان پردازشی بیشتر و هم به بهره‌وری بالاتر از این توان نیاز دارد. ما در حال ایجاد مجموعه‌ای تاب‌آور از زیرساخت‌ها هستیم و هر بار کاری را به مناسب‌ترین سامانه برای اجرای آن اختصاص می‌دهیم. این رویکرد از هر دو سوی منحنی قیمت‌ـ‌عملکرد پشتیبانی می‌کند. در بخش کم‌هزینه‌تر، قیمت‌های جدید Luna و Terra اجرای حجم بالای کار را در مقیاسی بسیار بزرگ‌تر اقتصادی می‌کنند. در بخش پیشرو، حالت سریع هنگام اهمیت داشتن زمان پاسخ، دسترسی سریع‌تری به Sol برای مشتریان API فراهم می‌کند.

سازمان‌ها می‌توانند بدون کاهش سرعت در مهم‌ترین کارهایشان، هوش مصنوعی بیشتری را وارد عملیات روزمره کنند. تحلیل گسترده اسناد، دسته‌بندی تعاملات مشتریان و پیاده‌سازی‌های معمول را می‌توان به‌شکلی اقتصادی و فراگیر اجرا کرد؛ در عین حال، بارهای کاری پیچیده Sol هرگاه پرداخت هزینه بیشتر توجیه داشته باشد، سریع‌تر انجام می‌شوند.

این دستاوردها می‌توانند یکدیگر را تقویت کنند. در فرایندی با هدایت انسان، مدل‌های توانمندتر به تیم فنی ما کمک می‌کنند نسل بعدی بهبودها را پیدا کند و مسیر دستیابی به عملکرد بهتر و هزینه کمتر را کوتاه‌تر سازد. راهبرد ما همچنان بر پیشبرد هم‌زمان توانمندی و بهره‌وری متمرکز است تا هر نسل از هوشمندی بتواند کار بیشتری را با هزینه کمتر انجام دهد.

دسترسی و قیمت‌گذاری

GPT‑5.6 Terra و Luna همچنان در ChatGPT Work،‏ Codex و API شرکت OpenAI در دسترس‌اند. در ChatGPT Work و Codex، کاربران Free و ChatGPT Go به Terra دسترسی دارند و کاربران ChatGPT Plus،‏ ChatGPT Pro،‏ Business و Enterprise می‌توانند Terra و Luna را انتخاب کنند.

از ۳۰ ژوئیه، قیمت API برای Terra به‌ازای هر یک میلیون توکن ورودی ۲ دلار و هر یک میلیون توکن خروجی ۱۲ دلار، و برای Luna به‌ترتیب ۰٫۲۰ و ۱٫۲۰ دلار خواهد بود. قیمت Sol بدون تغییر می‌ماند. قیمت اشتراک‌ها و سقف سهمیه ChatGPT و Codex تغییری نمی‌کند، اما استفاده از Terra و Luna اکنون اعتبار کمتری مصرف می‌کند. اعمال تدریجی تغییرات قیمت در AWS از اواخر امروز آغاز می‌شود.

حالت سریع GPT‑5.6 Sol جایگزین Priority Processing در API می‌شود و با /fast در Codex هم‌راستا است. درخواست‌های فعلی API که برچسب priority دارند همچنان کار خواهند کرد. جزئیات کامل قیمت‌گذاری API را ببینید.

نویسنده

OpenAI