Ana içeriğe atla
OpenAI

30 Temmuz 2026

Ürün

GPT‑5.6 ile fiyat-performans sınırını ileri taşımak

OpenAI, her katmanı daha verimli hâle getirerek daha fazla kurumsal iş yükünde dolar başına daha yüksek performans sunuyor.

Yükleniyor...

Dün, GPT‑5.6'nın kendi çalışma verimliliğini nasıl artırdığını paylaşmıştık. Bugün bu kazanımları, API'de GPT‑5.6 Luna(yeni bir pencerede açılır) ve Terra(yeni bir pencerede açılır) için daha düşük fiyatlar, GPT‑5.6 Sol içinse daha yüksek performans sunarak müşterilerimize aktarıyoruz. Bu güncellemeler, müşterilerin yapay zekaya yatırdıkları her dolardan daha fazla yararlanmasına ve zamanın kritik olduğu durumlarda daha hızlı ilerlemesine yardımcı oluyor.

Bugünden itibaren en hızlı ve en uygun fiyatlı modelimiz GPT‑5.6 Luna'nın fiyatı %80, günlük işler için dengeli modelimiz GPT‑5.6 Terra'nın fiyatıysa %20 düşüyor. Luna ve Terra'nın düşen fiyatları, Codex ve ChatGPT Work kullanılırken ücretli aboneliklerde kullanımın nasıl hesaplandığına da yansıyor. Luna, işletmelere yüksek hacimli işleri çok yüksek kalite düzeyinde yürütmek için çok daha uygun maliyetli bir yol sunuyor. Araçları kullanıp çok adımlı iş akışlarını tamamlayabildiğinden, daha geniş bir yapay zeka uygulaması yelpazesinin büyük ölçekte çalıştırılmasını mümkün kılıyor.

İleri düzey zekayı daha bol ve uygun fiyatlı hâle getirmek, AGI'ın (genel yapay zeka) tüm insanlığa fayda sağlamasını güvence altına alma yönündeki OpenAI misyonunun merkezinde yer alıyor. Bu değişiklikler, söz konusu taahhüdü hayata geçiriyor. Bu değişiklikler, modellerimizi oluşturma, sunma ve kullanıma alma biçimimizde yıllar boyunca kaydettiğimiz ilerlemeleri yansıtıyor.

Ayrıca API'de Priority Processing hizmetimizin yerini alan Hızlı modu kullanıma sunuyoruz. Hızlı mod, GPT‑5.6 Sol için artık akıl yürütme düzeyinde değişiklik olmadan Standart işlemeye kıyasla iki katı fiyata 2,5 kata kadar daha yüksek hız sunuyor. Hızlı mod geriye dönük uyumludur: priority etiketi taşıyan istekler otomatik olarak Hızlı modu kullanır.

1 / 6
GPT‑5.6 Luna, maliyeti ölçmeye değmeyecek kadar ucuz zekaya şimdiye dek en çok yaklaştığımız model. Bu kadar uygun fiyatlı bir modelin bu denli güçlü olduğuna hiç tanık olmadım. Replit için uzun süre geliştirmeyi beklemediğimiz kullanım senaryolarını mümkün kılıyor.
Michele Catasta, Replit Başkanı & Yapay Zeka Birimi Başkanı

Akıl yürütme düzeyini sonuca göre belirlemek

Yapay zekayı verimli kullanmak, hedeflenen sonuçla başlar. İşin önemi, hata maliyeti, aciliyeti ve ölçeği; akıl yürütme düzeyi, hız, güvenilirlik ve maliyet arasındaki doğru dengeyi belirler. Bu denge, iş akışının bir adımından diğerine değişebilir.

GPT‑5.6, işletmelere bu denklemi optimize etmek için çok daha geniş bir alan sunuyor. Luna, bir yıl önce en üst seviye kabul edilen modellere kıyaslanabilir performansı görev başına yaklaşık 6 sentlik maliyetle ve neredeyse dokuz kat hızla sunuyor. Agents’ Last Exam ile ölçülen profesyonel işlerde Luna, görev başına tahmini maliyeti yaklaşık %99 daha düşük olmasına rağmen Fable 5'ten daha iyi performans gösteriyor.

İşletmeler pratikte ihtiyaç duydukları sonucu ve kalite standardını tanımlayabilir; ardından ek akıl yürütme düzeyinin sonucu nerede belirgin biçimde iyileştirdiğini ve daha hızlı, düşük maliyetli işlemenin nerede aynı kaliteyi sağlayabildiğini değerlendirmelerle belirleyebilir. Örneğin bir kodlama iş akışı, belirsizliği gidermek ve planı belirlemek için Sol'u; ayrıntıları netleştirilmiş değişiklikleri uygulamak, testleri yazıp çalıştırmak ve sonuçları değerlendirmek içinse Luna'yı kullanabilir. Başka bir iş akışı farklı bir denge gerektirebilir.

GPT‑5.6 ailesi, bu seçeneklerin kapsamını genişletiyor. İşletmeler, yarattığı değere uygun bedeli öderken her aşamada faydalı olan en yüksek akıl yürütme düzeyinden yararlanabilir.

Bu esnekliği sunmak, modellerin arkasındaki her katmanı daha verimli hâle getirmekle başlıyor.

Verimlilik sınırını nasıl ileri taşıyoruz?

Verimlilik avantajımız; modelleri, onları çalıştıran çıkarım sistemlerini ve araçlarla bağlama bağlayan ajan tabanlı düzeneği geliştirmemizden kaynaklanıyor. GPT‑5.6 modelleri, işleri daha doğrudan bir yoldan tamamlıyor. Daha iyi yönlendirme donanımın verimli çalışmasını sağlıyor, optimize edilmiş üretim yazılımı tokenları daha verimli üretiyor ve daha akıllı bağlam yönetimi, ajanların tamamlanmış işleri tekrarlamasını önlüyor. Bu iyileştirmeler sayesinde aynı işlem gücüyle daha fazla faydalı işi tamamlayabiliyor; her sonuç için gereken süreyi, token sayısını ve maliyeti azaltabiliyoruz.

GPT‑5.6 Sol, yeni kazanımları bulup hayata geçirmemize giderek daha fazla yardımcı oluyor. Sol, insan yönetimindeki bir süreçte üretim çekirdeklerini otonom olarak yeniden yazıp optimize etti, token üretimini iyileştirmek için yüzlerce deney tasarlayıp yürüttü ve eğitimi izleyerek sorunlar çıktığında müdahale etti. Çekirdekler üzerinde yapılan çalışmalar, modeli sunmanın uçtan uca maliyetini %20 azaltmaya yardımcı olurken deneyler token üretim verimliliğini %15'in üzerinde artırdı. Bu çalışmalar sürüyor ve geri bildirim döngüsünü sıkılaştırıyor: Modellerimiz geliştikçe ve daha otonom çalışabildikçe verimliliği artırma hızımız da yükseliyor. GPT‑5.6'nın arkasındaki mühendislik hakkında daha fazla bilgi edinin.

Büyük ölçek için tasarlanmış işlem gücü stratejisi

Bol miktarda zekaya yönelik talebi karşılamak, hem daha fazla hem de daha verimli işlem gücü gerektiriyor. Dayanıklı bir altyapı portföyü oluşturuyor ve her iş yükünü, onu çalıştırmaya en uygun sistemlerle eşleştiriyoruz. Bu yaklaşım, fiyat-performans eğrisinin iki ucunu da destekliyor. Düşük maliyetli uçta, Luna ve Terra'nın yeni fiyatları yüksek hacimli işleri çok daha büyük ölçekte ekonomik hâle getiriyor. En üst seviye uçta ise Hızlı mod, yanıt süresi önemli olduğunda API müşterilerinin Sol'a daha hızlı erişmesini sağlıyor.

Kuruluşlar, en kritik işlerinde hızdan ödün vermeden günlük operasyonlarına daha fazla yapay zeka taşıyabilir. Büyük ölçekli belge analizi, müşteri etkileşimlerini sınıflandırma ve rutin uygulama işleri geniş çapta ekonomik olarak yürütülebilir; daha yüksek maliyetin haklı olduğu durumlarda karmaşık Sol iş yükleri de daha hızlı ilerleyebilir.

Kazanımlar katlanarak artabilir. İnsan yönetimindeki bir süreçte daha yetenekli modeller, teknik ekibimizin yeni nesil iyileştirmeleri bulmasına yardımcı olarak daha yüksek performansa ve daha düşük maliyetlere giden yolu kısaltıyor. Stratejimiz, her yeni zeka neslinin daha düşük maliyetle daha fazla iş başarabilmesi için hem yetenekleri hem de verimliliği geliştirmeye odaklanmayı sürdürüyor.

Kullanılabilirlik ve fiyatlandırma

GPT‑5.6 Terra ve Luna; ChatGPT Work, Codex ve OpenAI API'de sunulmaya devam ediyor. ChatGPT Work ve Codex'te Free ve Go kullanıcıları Terra'ya erişebilirken Plus, Pro, Business ve Enterprise kullanıcıları Terra ile Luna arasında seçim yapabilir.

30 Temmuz'dan itibaren API fiyatları Terra için milyon giriş tokenı başına 2 ABD doları ve milyon çıkış tokenı başına 12 ABD doları; Luna içinse sırasıyla 0,20 ve 1,20 ABD doları olacak. Sol fiyatları değişmiyor. ChatGPT ve Codex abonelik fiyatları ile kota bütçeleri değişmezken Terra ve Luna kullanımı artık daha az kredi tüketiyor. Fiyat değişiklikleri bugün ilerleyen saatlerde AWS'de kullanıma sunulmaya başlayacak.

GPT‑5.6 Sol için Hızlı mod, API'deki Priority Processing'in yerini alıyor ve Codex'teki /fast ile uyumlu çalışıyor. priority etiketi taşıyan mevcut API istekleri çalışmaya devam edecek. API fiyatlandırmasının tüm ayrıntılarını görüntüleyin.

Yazar

OpenAI