مرکزی مواد پر جائیں
OpenAI

۲۲ ستمبر، ۲۰۲۶

پروڈکٹ

GPT‑6 کے لیے بہتر پرامپٹ کیچنگ

بلند کیش ہِٹ ریٹ اور نئے ٹولز، جو دیرپا ایجنٹس کو زیادہ تیزی اور کم لاگت سے چلانے میں مدد دیں.

لوڈ ہو رہا ہے…

GPT‑6 دیرپا ایجنٹس کو پیچیدہ کاموں پر گھنٹوں کام کرنے کے قابل بناتا ہے، چاہے کوڈ بیسز کی ازسرِنو ساخت ہو یا جامع تحقیق پر مبنی دستاویزات اور پیشکشیں تیار کرنا. ان ایجنٹس کے پسِ پشت موجود ایپلیکیشنز یکے بعد دیگرے API درخواستیں کرتی ہیں، جن میں اکثر سابقہ مراحل کی وہی ہدایات، ٹول کی تعریفیں اور سیاق آگے منتقل ہوتے ہیں. OpenAI اس مشترکہ سیاق کو کیش کرتا ہے تاکہ درخواستوں کے درمیان کمپیوٹیشن دوبارہ استعمال ہو، جواب کا وقت کم ہو اور ڈیولپرز کو کیش شدہ ان پٹ ٹوکنز پر 90% تک رعایت ملے.

GPT‑6 فیملی کے ساتھ ہم نے پرامپٹ کیچنگ کا ایک بہتر نظام متعارف کرایا، جو پہلے سے طے شدہ طور پر بلند کیش ہِٹ ریٹ فراہم کرتا ہے. اب ہم 30 منٹ کے اندر دوبارہ استعمال ہونے والے اہل مشترکہ سابقوں پر کیش رعایت دیتے ہیں. ہم نئے ٹولز بھی متعارف کرا رہے ہیں جو ڈیولپرز کو کیش کی کارکردگی پر نظر رکھنے، کیش مِس کی تشخیص کرنے اور یہ طے کرنے میں مدد دیں گے کہ پرومپٹ کا کتنا حصہ کیش کیا جائے.

OpenAI کی پرامپٹ کیچنگ، GitHub Copilot کو بڑے پیمانے پر تیز اور مؤثر تجربات فراہم کرنے میں کلیدی کردار ادا کرتی ہے. گزشتہ کئی مہینوں میں، OpenAI ماڈلز کو کی گئی اربوں درخواستوں میں ہم نے سابقہ بنیادی معیار کے مقابلے میں تازہ پراسیسنگ درکار کرنے والے پرومپٹ ٹوکنز کا تناسب 50% سے زیادہ کم کیا ہے. اس کے نتیجے میں انفرنس کا نظام زیادہ مؤثر ہوا اور ڈیولپرز کو پہلا جواب زیادہ تیزی سے ملنے لگا.
—ماریو روڈریگیز، چیف پروڈکٹ آفیسر

کیچنگ کی نگرانی اور کیش مِس کی تشخیص کریں

نیا پرامپٹ کیچنگ ڈیش بورڈ(نئی ونڈو میں کھلتا ہے) دکھاتا ہے کہ آپ کی ایپلیکیشن کے ان پٹ کا کتنا حصہ کیش سے فراہم ہوتا ہے. وقت کے ساتھ ہِٹ ریٹ پر نظر رکھیں اور کیش شدہ و غیر کیش شدہ ٹوکنز کا موازنہ کرنے کے لیے ان پٹ ساخت کا چارٹ استعمال کریں. یہ مناظر کیش ہِٹس میں کمی کی نشاندہی اور ایپلیکیشن میں تبدیلیوں کے کیچنگ کی کارکردگی پر اثرات کا جائزہ لینے میں مدد دیتے ہیں.

پرامپٹ کیچنگ ڈیش بورڈ، جس میں کیش ہِٹ ریٹ، وقت کے ساتھ کیش کی کارکردگی اور ان پٹ ٹوکنز کی ساخت دکھائی گئی ہے.

غیر متوقع کیش مِس نظر آنے پر یہ سمجھنے کے لیے پرامپٹ کیچنگ تشخیصی ٹول(نئی ونڈو میں کھلتا ہے) استعمال کریں کہ کیا ہوا. کسی درخواست کا حالیہ جواب سے موازنہ کر کے ماڈل، ٹولز، ترتیبات یا ان پٹ میں وہ تبدیلیاں شناخت کریں جنہوں نے دوبارہ استعمال کو روکا. متاثرہ ٹوکنز کی تخمینی تعداد اثر کی وسعت جانچنے اور یہ طے کرنے میں مدد دیتی ہے کہ کیش ہِٹ ریٹ کو زیادہ سے زیادہ کرنے کے لیے انضمام کو کیسے بہتر بنایا جائے.

{
  "prompt_cache_diagnostics": {
    "type": "cache_miss",
    "reason": "tools_changed",
    "comparison_reusable_tokens": 5629,
    "cache_missed_tokens": 5629
  }
}

اپنی ایپلیکیشن کے لیے کیچنگ بہتر بنائیں

طے کریں کہ کیا کیش کرنا ہے. واضح کیش بریک پوائنٹس آپ کو یہ منتخب کرنے دیتے ہیں کہ پرومپٹ کے کون سے سابقے دوبارہ استعمال ہوں. تازہ کردہ پرامپٹ کیچنگ رہنما(نئی ونڈو میں کھلتا ہے) بتاتا ہے کہ انہیں کیسے استعمال کریں، کیش شدہ سابقے کتنی دیر تک اہل رہتے ہیں، اور ٹولز و ان پٹس میں تبدیلیاں دوبارہ استعمال پر کیسے اثر ڈالتی ہیں.

کیش کو متاثر کیے بغیر ریزننگ کی سطح بدلیں. GPT‑6 ماڈلز میں اب آپ کیش کو متاثر کیے بغیر جوابات کے درمیان ریزننگ کی سطح بدل(نئی ونڈو میں کھلتا ہے) سکتے ہیں. درخواست کی سطح پر ریزننگ کی مقدار بدلے بغیر configuration_update شامل کر کے مشکل کام کے لیے سطح بڑھائیں یا معمول کی اگلی کارروائی کے لیے کم کریں. اس طرح دوبارہ قابلِ استعمال سیاق محفوظ رکھتے ہوئے آپ کام کے لیے درکار ریزننگ کی مقدار بدل سکتے ہیں.

ٹولز اور ہدایات بدلنے پر بھی کیش محفوظ رکھیں. ایجنٹ کی ٹول استعمال کرنے کی ضروریات بدلنے پر ٹول کی تعریفیں، اسکیما اور ترتیب مستحکم رکھیں تاکہ سابقہ سیاق دوبارہ قابلِ استعمال رہے. تعریفیں ہٹانے کے بجائے صرف متعلقہ ٹولز کو قابلِ استعمال بنانے کے لیے allowed_tools استعمال کریں، یا جب کسی ٹول کی ضرورت نہ ہو تو tool_choice کو none پر سیٹ کریں. پرانی ہدایات کو بدلنے کے لیے نئے ڈیولپر پیغامات کے ذریعے سیاق کے آخر میں نئی ہدایات شامل کریں. ٹولز میں تبدیلیاں منظم کرنے سے متعلق ہماری رہنمائی(نئی ونڈو میں کھلتا ہے) دیکھیں.

تاخیر کم کرنے کے لیے کیش کو پہلے سے تیار کریں. پیشگی تیاری(نئی ونڈو میں کھلتا ہے) معلوم سیاق کو پہلے سے تیار کرتی ہے، تاکہ درخواست آنے پر ماڈل جلد جواب دینا شروع کر سکے. مثلاً، صارف کے پہلا سوال پوچھنے سے پہلے کوئی ایپلیکیشن آغاز کے دوران مشترکہ ہدایات، ٹول کی تعریفیں یا حوالہ جاتی مواد پہلے سے تیار کر سکتی ہے. اس سے پراسیسنگ صارف کے انتظار کے وقت سے باہر ہو جاتی ہے.

یہ اختیاری کنٹرولز انجن کی پہلے سے طے شدہ کارکردگی کو مزید بہتر بناتے ہیں اور کیچنگ کو آپ کے کام کے بوجھ کے مطابق ڈھالنے میں مدد دیتے ہیں.

3 از 1
OpenAI کی پرامپٹ کیچنگ کی تشخیصی سہولتوں اور ڈیش بورڈ نے کیش ہِٹ ریٹ چند فیصد پوائنٹس بڑھانے میں ہماری مدد کی، جس سے لاگت 20% کم ہوئی. اب کیچنگ اچانک ناکام ہو تو ہمیں انتباہ ملتا ہے، اور بنیادی وجہ کی تشخیص کے لیے ہم Codex ایجنٹس استعمال کرتے ہیں. واضح بریک پوائنٹس کی بدولت ہم مستحکم سیاق کو کیش کر سکتے ہیں اور بار بار بدلنے والے مواد کو پرومپٹ کے آخر میں رکھ سکتے ہیں. اس سے مشترکہ سیاق کا تقریباً پورا حصہ دوبارہ استعمال کرتے ہوئے پس منظر کے کاموں کے لیے گفتگو کو فورک کرنا اقتصادی طور پر قابلِ عمل ہو گیا ہے.
—آرین حنیفی، چیف ٹیکنالوجی آفیسر

آغاز کریں

مصنف

OpenAI