स्किप करके मेन कंटेंट पर जाऍं
OpenAI

30 जुलाई 2026

प्रोडक्ट

GPT‑5.6 के साथ मूल्य-प्रदर्शन की सीमाएं आगे बढ़ाना

हर परत को अधिक कुशल बनाकर OpenAI अधिक उद्यम कार्यभारों में प्रति डॉलर बेहतर प्रदर्शन दे रहा है.

लोड किया जा रहा है...

कल हमने बताया था कि GPT‑5.6 ने खुद को चलाने में अधिक कुशल बनाने में कैसे मदद की. आज हम इन सुधारों का लाभ ग्राहकों तक पहुंचा रहे हैं. API में GPT‑5.6 Luna(एक नई विंडो में खुलेगा) और Terra(एक नई विंडो में खुलेगा) की कीमतें कम होंगी और GPT‑5.6 Sol का प्रदर्शन तेज़ होगा. इन अपडेट से ग्राहक AI में लगाए गए हर डॉलर का अधिक लाभ उठा सकते हैं और समय महत्वपूर्ण होने पर तेज़ी से आगे बढ़ सकते हैं.

आज से हमारे सबसे तेज़ और किफ़ायती मॉडल GPT‑5.6 Luna की कीमत 80% कम होगी, जबकि रोज़मर्रा के काम के लिए संतुलित मॉडल GPT‑5.6 Terra की कीमत 20% कम होगी. Luna और Terra की ये कम कीमतें Codex और ChatGPT Work का उपयोग करते समय सशुल्क सदस्यता के उपयोग की गणना में भी दिखाई देंगी. Luna व्यवसायों को बहुत उच्च गुणवत्ता के साथ बड़ी मात्रा में काम संभालने का कहीं अधिक किफ़ायती तरीका देता है. यह टूल का उपयोग करके कई चरणों वाले वर्कफ़्लो पूरे कर सकता है, जिससे AI अनुप्रयोगों की व्यापक शृंखला को बड़े पैमाने पर चलाना व्यावहारिक बनता है.

उन्नत बुद्धिमत्ता को अधिक सुलभ और किफ़ायती बनाना OpenAI के उस मिशन का केंद्र है, जिसका उद्देश्य यह सुनिश्चित करना है कि AGI से पूरी मानवता को लाभ हो. ये बदलाव उस प्रतिबद्धता को अमल में लाते हैं. ये हमारे मॉडलों के निर्माण, उन्हें उपलब्ध कराने और काम में लगाने के तरीकों में वर्षों से हुए सुधारों का परिणाम हैं.

हम API में तेज़ मोड भी पेश कर रहे हैं, जो हमारी प्राथमिकता प्रोसेसिंग पेशकश की जगह लेगा. GPT‑5.6 Sol के लिए तेज़ मोड अब स्टैंडर्ड प्रोसेसिंग की तुलना में दोगुनी कीमत पर 2.5 गुना तक तेज़ गति देता है, जबकि इंटेलिजेंस में कोई बदलाव नहीं होता. तेज़ मोड पश्चगामी संगत है: priority टैग वाले अनुरोध अपने-आप तेज़ मोड का उपयोग करेंगे.

6 में से 1
GPT‑5.6 Luna हमें ऐसी इंटेलिजेंस के सबसे करीब ले आया है, जिसकी लागत इतनी कम है कि उसे मापना भी बेमानी लगता है. मैंने इतने किफ़ायती मॉडल को कभी इतना शक्तिशाली नहीं देखा. यह Replit के लिए ऐसे उपयोग संभव बना रहा है, जिन्हें जल्द विकसित करने की हमें उम्मीद नहीं थी.
मिशेल कैटास्टा, Replit के अध्यक्ष और AI प्रमुख

नतीजे के अनुरूप इंटेलिजेंस का चयन

AI का कुशल उपयोग वांछित नतीजे से शुरू होता है. काम का महत्व, गलती की कीमत, तात्कालिकता और पैमाना मिलकर इंटेलिजेंस, गति, विश्वसनीयता और लागत का सही संतुलन तय करते हैं. यह संतुलन वर्कफ़्लो के हर चरण में बदल सकता है.

GPT‑5.6 व्यवसायों को इस समीकरण को बेहतर बनाने की कहीं अधिक गुंजाइश देता है. Luna लगभग 6 सेंट प्रति डॉलर प्रति कार्य की लागत और करीब नौ गुना गति पर उन मॉडलों के बराबर प्रदर्शन देता है, जिन्हें एक साल पहले अत्याधुनिक श्रेणी का माना जाता था. एजेंट्स लास्ट एग्ज़ाम से मापे गए पेशेवर काम में Luna, Fable 5 से बेहतर प्रदर्शन करता है और उसकी अनुमानित प्रति-कार्य लागत लगभग 99% कम है.

व्यवहार में व्यवसाय अपना वांछित नतीजा और गुणवत्ता मानक तय कर सकते हैं. फिर मूल्यांकन से यह निर्धारित कर सकते हैं कि अतिरिक्त इंटेलिजेंस कहां नतीजे को सार्थक रूप से बेहतर बनाता है और कहां तेज़ व कम लागत वाली प्रोसेसिंग समान गुणवत्ता दे सकती है. उदाहरण के लिए, कोई कोडिंग वर्कफ़्लो अनिश्चितता दूर करने और योजना तय करने के लिए Sol का उपयोग कर सकता है, फिर स्पष्ट रूप से निर्धारित बदलाव लागू करने, परीक्षण लिखने व चलाने और नतीजों का मूल्यांकन करने के लिए Luna का उपयोग कर सकता है. किसी दूसरे वर्कफ़्लो में अलग संतुलन की ज़रूरत हो सकती है.

GPT‑5.6 परिवार इन विकल्पों की सीमा बढ़ाता है. व्यवसाय हर चरण में अधिकतम उपयोगी इंटेलिजेंस लागू कर सकते हैं और उससे मिलने वाले मूल्य के अनुरूप सही कीमत चुका सकते हैं.

यह लचीलापन देने की शुरुआत मॉडलों के पीछे की हर परत को अधिक कुशल बनाने से होती है.

हम दक्षता की सीमाएं कैसे आगे बढ़ाते हैं

दक्षता में हमारी बढ़त मॉडलों, उन्हें चलाने वाले इन्फ़रेंस सिस्टम और उन्हें टूल व संदर्भ से जोड़ने वाले एजेंटिक हार्नेस को बेहतर बनाने से आती है. GPT‑5.6 मॉडल काम पूरा करने के लिए अधिक सीधा रास्ता अपनाते हैं. बेहतर रूटिंग हार्डवेयर का उत्पादक उपयोग बनाए रखती है, अनुकूलित प्रोडक्शन सॉफ़्टवेयर अधिक कुशलता से टोकन बनाता है और बेहतर संदर्भ प्रबंधन एजेंटों को पूरा हो चुका काम दोहराने से बचाता है. ये सुधार हमें समान कंप्यूट क्षमता से अधिक उपयोगी काम पूरा करने देते हैं और हर नतीजे के लिए आवश्यक समय, टोकन और लागत घटाते हैं.

GPT‑5.6 Sol अगली पीढ़ी के सुधार खोजने और उपलब्ध कराने में हमारी लगातार अधिक मदद कर रहा है. मानव-नेतृत्व वाली प्रक्रिया में Sol ने स्वायत्त रूप से प्रोडक्शन कर्नेल दोबारा लिखकर अनुकूलित किए, टोकन निर्माण बेहतर करने के लिए सैकड़ों प्रयोग तैयार करके चलाए और प्रशिक्षण की निगरानी करते हुए समस्याएं आने पर हस्तक्षेप किया. कर्नेल से जुड़े काम ने मॉडल उपलब्ध कराने की शुरू से अंत तक की लागत 20% घटाने में मदद की, जबकि इसके प्रयोगों ने टोकन-निर्माण दक्षता 15% से अधिक बढ़ाई. यह काम जारी है और इससे अधिक सघन फ़ीडबैक चक्र बन रहा है: जैसे-जैसे हमारे मॉडल बेहतर होते हैं और अधिक स्वायत्तता से काम कर पाते हैं, दक्षता सुधारने की हमारी क्षमता भी तेज़ होती जाती है. GPT‑5.6 के पीछे की इंजीनियरिंग के बारे में और पढ़ें.

बड़े पैमाने के लिए बनाई गई कंप्यूट रणनीति

प्रचुर इंटेलिजेंस की मांग पूरी करने के लिए अधिक कंप्यूट क्षमता और अधिक उत्पादक कंप्यूट क्षमता, दोनों आवश्यक हैं. हम एक सुदृढ़ इन्फ़्रास्ट्रक्चर पोर्टफ़ोलियो बना रहे हैं और हर कार्यभार को उसे चलाने के लिए सबसे उपयुक्त सिस्टम से जोड़ रहे हैं. यह तरीका मूल्य-प्रदर्शन वक्र के दोनों सिरों को सहारा देता है. कम लागत वाले सिरे पर Luna और Terra की नई कीमतें बड़ी मात्रा के काम को कहीं बड़े पैमाने पर किफ़ायती बनाती हैं. अत्याधुनिक सिरे पर, प्रतिक्रिया समय महत्वपूर्ण होने पर तेज़ मोड API ग्राहकों को Sol तक तेज़ पहुंच देता है.

उद्यम अपने सबसे महत्वपूर्ण काम की गति से समझौता किए बिना रोज़मर्रा के संचालन में अधिक AI अपना सकते हैं. बड़े पैमाने पर दस्तावेज़ विश्लेषण, ग्राहक संवाद का वर्गीकरण और नियमित कार्यान्वयन व्यापक उपयोग के लिए किफ़ायती हो सकते हैं, जबकि अतिरिक्त कीमत उचित होने पर जटिल Sol कार्यभार तेज़ी से पूरे किए जा सकते हैं.

इन लाभों का असर लगातार बढ़ सकता है. मानव-नेतृत्व वाली प्रक्रिया में अधिक सक्षम मॉडल हमारी तकनीकी टीम को अगली पीढ़ी के सुधार खोजने में मदद करते हैं, जिससे बेहतर प्रदर्शन और कम लागत तक पहुंचने का रास्ता छोटा होता है. हमारी रणनीति क्षमता और दक्षता, दोनों को आगे बढ़ाने पर केंद्रित है, ताकि इंटेलिजेंस की हर पीढ़ी कम लागत पर अधिक काम कर सके.

उपलब्धता और कीमत

GPT‑5.6 Terra और Luna, ChatGPT Work, Codex और OpenAI API में उपलब्ध रहेंगे. ChatGPT Work और Codex में Free और ChatGPT Go उपयोगकर्ता Terra का उपयोग कर सकते हैं, जबकि ChatGPT Plus, ChatGPT Pro, Business और Enterprise उपयोगकर्ता Terra और Luna में से चुन सकते हैं.

30 जुलाई से API में Terra के लिए प्रति दस लाख इनपुट टोकन की कीमत $2 और प्रति दस लाख आउटपुट टोकन की कीमत $12 होगी. Luna के लिए ये कीमतें क्रमशः $0.20 और $1.20 होंगी. Sol की कीमत में कोई बदलाव नहीं होगा. ChatGPT और Codex की सदस्यता कीमतें और कोटा बजट नहीं बदलेंगे, जबकि Terra और Luna का उपयोग अब कम क्रेडिट्स खर्च करेगा. AWS में कीमतों से जुड़े बदलाव आज बाद में लागू होने शुरू होंगे.

GPT‑5.6 Sol का तेज़ मोड API में प्राथमिकता प्रोसेसिंग की जगह लेता है और Codex के /fast के अनुरूप है. priority टैग वाले मौजूदा API अनुरोध पहले की तरह काम करते रहेंगे. API की कीमतों का पूरा विवरण देखें.

लेखक

OpenAI