پیشبرد مرز قیمتـعملکرد با GPT‑5.6
OpenAI با کارآمدتر کردن تمام لایهها، بهازای هر دلار عملکرد بهتری را در طیف گستردهتری از بارهای کاری سازمانی ارائه میدهد.
دیروز توضیح دادیم که GPT‑5.6 چگونه به اجرای کارآمدتر خود کمک کرده است. امروز این دستاوردها را با کاهش قیمت GPT‑5.6 Luna(در یک پنجره جدید باز میشود) و Terra(در یک پنجره جدید باز میشود) و افزایش سرعت GPT‑5.6 Sol در API در اختیار مشتریان میگذاریم. این بهروزرسانیها در کنار هم کمک میکنند مشتریان از هر دلاری که در هوش مصنوعی سرمایهگذاری میکنند بهره بیشتری ببرند و هرگاه زمان اهمیت دارد، سریعتر پیش بروند.
از امروز، هزینه GPT‑5.6 Luna، سریعترین و مقرونبهصرفهترین مدل ما، ۸۰٪ و هزینه GPT‑5.6 Terra، مدل متعادل ما برای کارهای روزمره، ۲۰٪ کاهش مییابد. این کاهش قیمت Luna و Terra در نحوه محاسبه مصرف اشتراکهای پولی هنگام استفاده از Codex و ChatGPT Work نیز اعمال میشود. Luna راهی بسیار مقرونبهصرفهتر در اختیار کسبوکارها میگذارد تا حجم بالای کار را با کیفیتی بسیار بالا انجام دهند. این مدل میتواند از ابزارها استفاده کند و گردشهای کاری چندمرحلهای را به پایان برساند؛ در نتیجه اجرای طیف گستردهتری از کاربردهای هوش مصنوعی در مقیاس بالا عملی میشود.
فراوانتر و مقرونبهصرفهتر کردن هوشمندی پیشرفته، محور مأموریت OpenAI برای تضمین بهرهمندی همه بشریت از AGI است. این تغییرات، آن تعهد را به عمل تبدیل میکنند. این تغییرات حاصل سالها بهبود در شیوه ساخت، ارائه و بهکارگیری مدلهای ما هستند.
همچنین حالت سریع را در API معرفی میکنیم که جایگزین سرویس Priority Processing ما میشود. حالت سریع برای GPT‑5.6 Sol اکنون با دو برابر قیمت، سرعتی تا ۲٫۵ برابر بیشتر از پردازش Standard ارائه میدهد، بیآنکه هوشمندی تغییر کند. حالت سریع با نسخههای قبلی سازگار است: درخواستهای دارای برچسب priority بهطور خودکار از حالت سریع استفاده میکنند.
استفاده کارآمد از هوش مصنوعی با نتیجه مطلوب آغاز میشود. اهمیت کار، هزینه خطا، فوریت و مقیاس، تعادل مناسب میان هوشمندی، سرعت، قابلیت اطمینان و هزینه را تعیین میکنند. این تعادل ممکن است از مرحلهای به مرحله دیگر گردش کار تغییر کند.
GPT‑5.6 فضای بسیار بیشتری برای بهینهسازی این معادله در اختیار کسبوکارها میگذارد. Luna با هزینهای حدود ۶ سنت بهازای هر دلار برای هر وظیفه و سرعتی نزدیک به ۹ برابر، عملکردی همسطح مدلهایی ارائه میدهد که یک سال پیش در رده پیشرو بودند. در کارهای حرفهای و بر اساس معیار «آخرین آزمون عاملها»، Luna با هزینه تخمینی هر وظیفه که نزدیک به ۹۹٪ کمتر است، از Fable 5 بهتر عمل میکند.
در عمل، کسبوکارها میتوانند نتیجه و معیار کیفیت موردنیازشان را تعریف کنند و سپس با ارزیابی مشخص کنند هوشمندی بیشتر در کجا نتیجه را بهطور محسوسی بهبود میدهد و پردازش سریعتر و کمهزینهتر در کجا همان کیفیت را فراهم میکند. برای نمونه، یک گردش کار کدنویسی میتواند از Sol برای رفع ابهام و تدوین برنامه استفاده کند و سپس با Luna تغییرات دقیقاً مشخصشده را پیادهسازی کند، آزمونها را بنویسد و اجرا کند و نتایج را بسنجد. گردش کاری دیگر ممکن است به تعادل متفاوتی نیاز داشته باشد.
خانواده GPT‑5.6 دامنه این انتخابها را گسترش میدهد. کسبوکارها میتوانند در هر مرحله از بیشترین هوشمندی مفید بهره بگیرند و متناسب با ارزشی که ایجاد میشود هزینه بپردازند.
فراهم کردن این انعطافپذیری با کارآمدتر کردن تمام لایههای پشتیبان مدلها آغاز میشود.
برتری ما در بهرهوری از بهبود مدلها، سامانههای استنتاجی که آنها را اجرا میکنند و چارچوب آزمون عاملمحوری ناشی میشود که آنها را به ابزارها و زمینه متصل میکند. مدلهای GPT‑5.6 مسیر مستقیمتری را برای انجام کار طی میکنند. مسیریابی بهتر، سختافزار را پربازده نگه میدارد؛ نرمافزار تولیدی بهینهشده، توکنها را کارآمدتر تولید میکند؛ و مدیریت هوشمندتر زمینه به عاملها کمک میکند کارهای تکمیلشده را تکرار نکنند. این بهبودها در کنار هم به ما امکان میدهند با توان پردازشی یکسان، کار مفید بیشتری انجام دهیم و زمان، توکن و هزینه لازم برای هر نتیجه را کاهش دهیم.
GPT‑5.6 Sol بیشازپیش به ما کمک میکند دور بعدی بهبودها را شناسایی و ارائه کنیم. Sol در فرایندی با هدایت انسان، کرنلهای عملیاتی را بهطور مستقل بازنویسی و بهینه کرد، صدها آزمایش برای بهبود تولید توکن طراحی و اجرا کرد و آموزش را زیر نظر گرفت و هنگام بروز مشکل مداخله کرد. کار روی کرنلها هزینه سرتاسری ارائه مدل را ۲۰٪ کاهش داد و آزمایشهای آن نیز بهرهوری تولید توکن را بیش از ۱۵٪ افزایش داد. این کار ادامه دارد و چرخه بازخورد فشردهتری ایجاد میکند: هرچه مدلهای ما بهتر و قادر به کار مستقلتر شوند، سرعت افزایش بهرهوری ما نیز بیشتر میشود. درباره مهندسی زیربنای GPT‑5.6 بیشتر بخوانید.
پاسخگویی به تقاضا برای هوشمندی فراوان، هم به توان پردازشی بیشتر و هم به بهرهوری بالاتر از این توان نیاز دارد. ما در حال ایجاد مجموعهای تابآور از زیرساختها هستیم و هر بار کاری را به مناسبترین سامانه برای اجرای آن اختصاص میدهیم. این رویکرد از هر دو سوی منحنی قیمتـعملکرد پشتیبانی میکند. در بخش کمهزینهتر، قیمتهای جدید Luna و Terra اجرای حجم بالای کار را در مقیاسی بسیار بزرگتر اقتصادی میکنند. در بخش پیشرو، حالت سریع هنگام اهمیت داشتن زمان پاسخ، دسترسی سریعتری به Sol برای مشتریان API فراهم میکند.
سازمانها میتوانند بدون کاهش سرعت در مهمترین کارهایشان، هوش مصنوعی بیشتری را وارد عملیات روزمره کنند. تحلیل گسترده اسناد، دستهبندی تعاملات مشتریان و پیادهسازیهای معمول را میتوان بهشکلی اقتصادی و فراگیر اجرا کرد؛ در عین حال، بارهای کاری پیچیده Sol هرگاه پرداخت هزینه بیشتر توجیه داشته باشد، سریعتر انجام میشوند.
این دستاوردها میتوانند یکدیگر را تقویت کنند. در فرایندی با هدایت انسان، مدلهای توانمندتر به تیم فنی ما کمک میکنند نسل بعدی بهبودها را پیدا کند و مسیر دستیابی به عملکرد بهتر و هزینه کمتر را کوتاهتر سازد. راهبرد ما همچنان بر پیشبرد همزمان توانمندی و بهرهوری متمرکز است تا هر نسل از هوشمندی بتواند کار بیشتری را با هزینه کمتر انجام دهد.
GPT‑5.6 Terra و Luna همچنان در ChatGPT Work، Codex و API شرکت OpenAI در دسترساند. در ChatGPT Work و Codex، کاربران Free و ChatGPT Go به Terra دسترسی دارند و کاربران ChatGPT Plus، ChatGPT Pro، Business و Enterprise میتوانند Terra و Luna را انتخاب کنند.
از ۳۰ ژوئیه، قیمت API برای Terra بهازای هر یک میلیون توکن ورودی ۲ دلار و هر یک میلیون توکن خروجی ۱۲ دلار، و برای Luna بهترتیب ۰٫۲۰ و ۱٫۲۰ دلار خواهد بود. قیمت Sol بدون تغییر میماند. قیمت اشتراکها و سقف سهمیه ChatGPT و Codex تغییری نمیکند، اما استفاده از Terra و Luna اکنون اعتبار کمتری مصرف میکند. اعمال تدریجی تغییرات قیمت در AWS از اواخر امروز آغاز میشود.
حالت سریع GPT‑5.6 Sol جایگزین Priority Processing در API میشود و با /fast در Codex همراستا است. درخواستهای فعلی API که برچسب priority دارند همچنان کار خواهند کرد. جزئیات کامل قیمتگذاری API را ببینید.


