முக்கிய உள்ளடக்கத்திற்கு செல்க
OpenAI

GPT‑5.6 Sol முன்னோட்டம்: அடுத்த தலைமுறை மாடல்

ஏற்றுகிறது…

GPT‑5.6 தொடரின் வரையறுக்கப்பட்ட முன்னோட்டத்தைத் தொடங்குகிறோம்: எங்கள் ஃப்ளாக்ஷிப் மாடலான Sol; அன்றாட பணிக்கான சமநிலை மாடலான Terra; மற்றும் வேகமான, மலிவான மாடலான Luna. Terra, GPT‑5.5‑க்கு போட்டியான செயல்திறனை 2 மடங்கு குறைந்த செலவில் வழங்குகிறது; Luna எங்களின் மிகக் குறைந்த செலவில் வலுவான திறனை கொண்டு வருகிறது.

GPT‑5.6 Sol, இதுவரை எங்களின் மிக வலிமையான பாதுகாப்பு அடுக்குடன் அறிமுகமாகிறது. அதிக ஆபத்துள்ள செயல்பாடு, நுணுக்கமான சைபர் கோரிக்கைகள், மீண்டும் மீண்டும் நிகழும் தவறான பயன்பாடு ஆகியவற்றுக்கான பாதுகாப்புகளை வலுப்படுத்தினோம்; பல வாரங்கள் பலவீனங்களை கண்டறிந்து, எங்கள் சிஸ்டத்தை அழுத்தச் சோதனை செய்து, நிஜ உலக தாக்குதல்களுக்கு எதிராக அதை உறுதிப்படுத்தினோம்.

பரவலான அணுகலை நாங்கள் நம்புகிறோம்; வரும் வாரங்களில் GPT‑5.6 Sol, Terra மற்றும் Luna பொதுவாக கிடைக்கச் செய்ய திட்டமிட்டுள்ளோம். அமெரிக்க அரசுடன் எங்களின் தொடர்ச்சியான ஈடுபாட்டின் ஒரு பகுதியாக, இன்றைய அறிமுகத்திற்கு முன் எங்கள் திட்டங்களையும் மாடல்களின் திறன்களையும் முன்னோட்டமாக பகிர்ந்தோம். அவர்களின் கோரிக்கைப்படி, மேலும் பரவலாக வெளியிடுவதற்கு முன், அரசுடன் பகிரப்பட்டுள்ள பங்கேற்பைக் கொண்ட நம்பகமான சிறிய கூட்டாளர்கள் குழுவுக்கான வரையறுக்கப்பட்ட முன்னோட்டத்துடன் தொடங்குகிறோம். இந்த முன்னோட்டத்தின்போது, பரவலான கிடைக்குமிடத்தை நோக்கி பணியாற்றுவதுடன், கூட்டாளர்களுடன் நெருக்கமாக ஒருங்கிணைந்து தொடர்ந்து சோதிப்போம். இவ்வகையான அரசு அணுகல் செயல்முறை நீண்டகால இயல்புநிலையாக மாற வேண்டும் என்று நாங்கள் நம்பவில்லை. அவை தேவைப்படும் பயனர்கள், டெவலப்பர்கள், நிறுவனங்கள், சைபர் பாதுகாப்பாளர்கள், உலகளாவிய கூட்டாளர்கள் ஆகியோரிடமிருந்து சிறந்த கருவிகளை இது விலக்கி வைக்கிறது. வரும் வாரங்களில் பரவலான கிடைக்குமிடத்துக்கான மிக வலுவான பாதை இதுவே என்று நாங்கள் நம்புவதால், இந்த குறுகியகால படியை எடுக்கிறோம்; அதேவேளை சைபர் Executive Order கட்டமைப்பையும் எதிர்கால மாடல் வெளியீடுகளுக்கான மீண்டும் பயன்படுத்தக்கூடிய செயல்முறையையும் உருவாக்க Administration உடன் பணியாற்றுகிறோம்.

திறன்கள்

GPT‑5.6 Sol இதுவரை எங்களின் மிக வலுவான மாடல். மாடல் செயல்திறனின் முன்னோட்டத்தை வழங்க, கோடிங், உயிரியல், சைபர் பாதுகாப்பு ஆகியவற்றில் மேம்பட்ட ஏஜென்ட் சார்ந்த திறன்களை முன்னிறுத்தும் மதிப்பீடுகளின் தொகுப்பை பகிர்கிறோம்; கூடுதல் பாதுகாப்பு மற்றும் தயார்நிலை மதிப்பீடுகள் எங்கள் சிஸ்டம் கார்டில்(புதிய சாளரத்தில் திறக்கும்) கிடைக்கின்றன. மாடலை பரவலாகக் கிடைக்கச் செய்யும்போது விரிவான மதிப்பீட்டு முடிவுகளின் தொகுப்பை பகிர்வோம்.

GPT‑5.6 உடன், Sol ஆழமாக ரீஸனிங் செய்ய அதிக நேரம் பெற புதிய `மேக்ஸ்` ரீஸனிங் முயற்சியை அறிமுகப்படுத்துகிறோம். மேலும், சிக்கலான பணிகளை வேகப்படுத்த துணை ஏஜென்ட்களைப் பயன்படுத்தி, ஒரே ஏஜென்டின் திறன்களைத் தாண்டிச் செல்லும் புதிய `அல்ட்ரா` முறையையும் அறிமுகப்படுத்துகிறோம்.

கோடிங் பணிப்பாய்வுகளுக்கு, திட்டமிடல், மீள்பணி, கருவி ஒருங்கிணைப்பு தேவைப்படும் கட்டளை வரிப் பணிப்பாய்வுகளைச் சோதிக்கும் Terminal‑Bench 2.1-இல் GPT‑5.6 Sol புதிய state of the art நிலையை நிர்ணயிக்கிறது.

GPT‑5.6 Sol உயிரியல் பணிப்பாய்வுகளிலும் பரவலான மேம்பாடுகளை காட்டுகிறது. நீண்டகால ஜீனோமிக்ஸ் மற்றும் அளவுரு-உயிரியல் பகுப்பாய்வுகளை மதிப்பிடும் GeneBench v1-இல், குறைவான டோக்கன்களைப் பயன்படுத்தியபடியே GPT‑5.5-ஐ விட வலுவான முடிவுகளை அடைகிறது.

GPT‑5.6 Sol சைபர் பாதுகாப்புக்கான எங்களின் இதுவரையிலான மிகத் திறனுள்ள மாடல். பாதிப்புத் தேடல் மற்றும் எக்ஸ்ப்ளாய்டேஷன் உட்பட நீண்டகால பாதுகாப்புப் பணிகளுக்கான செயல்திறன்-திறன் முன்னணியை இது மாற்றுகிறது. ExploitBench²-இல், வெளியீட்டு டோக்கன்களின் சுமார் ~1/3 மட்டுமே பயன்படுத்தி GPT‑5.6 Sol, Mythos முன்னோட்டத்திற்கு போட்டியாக உள்ளது. OpenAI மற்றும் பிற அதிநவீன ஆய்வகங்களுடன் இணைந்து UC Berkeley ஆராய்ச்சியாளர்கள் உருவாக்கிய பெஞ்ச்மார்க்கான ExploitGym(புதிய சாளரத்தில் திறக்கும்)3-இல், ரீஸனிங்கை அதிகரிக்கும்போது GPT‑5.6 Sol, Terra, Luna மாடல்கள் அனைத்தும் சைபர் திறன்களில் வலுவான மேம்பாடுகளை காட்டுகின்றன.

வலுவான பாதுகாப்புகளுடன் வலுவான சைபர் திறன்கள்

ஒவ்வொரு மாடலின் திறன்களுக்கும் பொருந்தும் உள்ளமைவுகளுடன், இதுவரை எங்களின் மிக வலிமையான பாதுகாப்புகளைக் கொண்டு GPT‑5.6 Sol, Terra மற்றும் Luna-ஐ உருவாக்கினோம். மாடல் அதிக திறன் பெறும்போது, கோடிங் மதிப்பாய்வு, பாதிப்புத் தேடல், பேட்ச் உருவாக்கம், பிழைநீக்கம், பாதுகாப்புக் கல்வி, தற்காப்புச் சோதனை போன்ற சட்டபூர்வ பணிகளுக்கான அணுகலை பாதுகாத்தபடி, நிஜ உலக எதிர்மறை அழுத்தத்தையும் அதிகமாகத் தாங்கும் வகையில் பாதுகாப்புகளை வடிவமைக்கிறோம். அந்தப் பயனுள்ள பயன்பாடுகளை தேவையின்றி கட்டுப்படுத்தாமல், தடைசெய்யப்பட்ட தாக்குதல் செயல்பாட்டை மேலும் கடினமாகவும், நிச்சயமற்றதாகவும், கண்டறியக்கூடியதாகவும் மாற்றுவதே எங்கள் குறிக்கோள். மாடல் மற்றும் பாதுகாப்புகள் பற்றிய எங்கள் மதிப்பீட்டின் அடிப்படையில், தடைசெய்யப்பட்ட தாக்குதல் பயன்பாட்டை அர்த்தமுள்ள வகையில் கட்டுப்படுத்தியபடி, சட்டபூர்வ தற்காப்புப் பணிக்கு குறிப்பிடத்தக்க நன்மை கிடைக்கும் என்று எதிர்பார்க்கிறோம்.

முழுமையான தொடர் தாக்குதல்களை நம்பகமாக நடத்துவதை விட, பாதிப்புகளை கண்டறிந்து சரிசெய்ய மக்களுக்கு உதவுவதில் GPT‑5.6 Sol சிறந்தது. இந்த திறன்கள் தொடர்ந்து முன்னேறும்போது, பலவீனங்களை கண்டறிய, பேட்ச்களை உருவாக்க, சிஸ்டங்களை பரவலாக வலுப்படுத்த இந்த கருவிகளைப் பயன்படுத்தக்கூடிய பாதுகாப்பாளர்களை அவை சென்றடைந்து அவர்களுக்கு நன்மை பயப்பதை உறுதி செய்வதே எங்கள் முன்னுரிமை.

GPT‑5.6 Sol, எங்கள் பிரிபேர்ட்நெஸ் ஃப்ரேம்வொர்க்கின் கீழ் சைபர் கிரிட்டிகல் வரம்பைத் தாண்டவில்லை. Chromium மற்றும் Firefox தொடர்பான மதிப்பீடுகளில், அது பிழைகளையும் எக்ஸ்ப்ளாயிட் உருவாக்கக் கூறுகளான எக்ஸ்ப்ளாயிட் அடிப்படைகளையும் கண்டறிந்தது; ஆனால் சோதிக்கப்பட்ட சூழ்நிலைகளில் தன்னிச்சையாக செயல்படும் முழு-சங்கிலி எக்ஸ்ப்ளாயிடை உருவாக்கவில்லை. இருப்பினும், ஒரு மாடல் பயன்படுத்தப்படக்கூடிய அல்லது பிற கருவிகளுடன் இணைக்கப்படக்கூடிய ஒவ்வொரு வழியையும் பெஞ்ச்மார்க் வரம்புகள் பதிவு செய்ய முடியாது. அந்த நிச்சயமின்மையும், மாடலின் பரந்த திறன் முன்னேற்றமும் காரணமாக, மாடலின் அதிகரித்த திறன்களுடன் வலுவான பாதுகாப்புகளையும் கட்டப்படியான வெளியீட்டையும் இணைக்கிறோம். எங்கள் பாதுகாப்புகள் பற்றிய கூடுதல் விவரங்களை GPT‑5.6 முன்னோட்ட சிஸ்டம் கார்டில்(புதிய சாளரத்தில் திறக்கும்) பகிர்கிறோம்.

அடுக்குகளைக் கொண்ட பாதுகாப்பு அடுக்கு

உறுதியான அல்லது தழுவிக்கொள்ளும் தவறான பயன்பாட்டுக்கு எதிராக எந்த ஒரு பாதுகாப்பும் தனியாக போதாது. GPT‑5.6 முன்னோட்டம் முழுவதும், மாடல்களுக்கு ஏற்ப சரியான உள்ளமைவுகள் மாறுபடும் அடுக்குப் பாதுகாப்புகளைப் பயன்படுத்தி, அவற்றை நிஜ உலக தாக்குதல்களுக்கு எதிராக அழுத்தச் சோதனை செய்கிறோம். மாடலில் பயிற்றுவிக்கப்பட்ட பாதுகாப்புகள், உருவாக்கத்தின்போது நேரடி சோதனைகள், கணக்கு-நிலை சிக்னல்கள், வேறுபடுத்தப்பட்ட அணுகல், கண்காணிப்பு, அமலாக்கம், தொடர்ச்சியான சோதனை ஆகியவை இதில் அடங்கும்.

பயனர்கள் தங்கள் நோக்கத்தை மறைக்க அல்லது மாடலை ஜெயில்பிரேக் செய்ய முயன்றாலும், தடைசெய்யப்பட்ட சைபர் உதவியை மறுக்கும் வகையில் GPT‑5.6 பயிற்றுவிக்கப்பட்டுள்ளது. மாடல் எந்த விஷயங்களில் உதவ வேண்டும், உதவக்கூடாது என்பதற்கான முதல் எல்லையை இந்த மாடல்-நிலை பாதுகாப்புகள் அமைக்கின்றன.

உருவாக்கப்படும் வெளியீட்டை மதிப்பிடுவதன் மூலம், நேரடி சைபர் மற்றும் உயிரியல் தவறான பயன்பாட்டு வகைப்பான்கள் இன்னொரு பாதுகாப்பு அடுக்கை வழங்குகின்றன. அதிக ஆபத்துள்ள நிலைகளில், சாத்தியமான மீறலை அவை கண்டறிந்தால், பெரிய ரீஸனிங் மாடல் உரையாடலையும் அதன் சூழலையும் மதிப்பாய்வு செய்யும் வரை உருவாக்கம் இடைநிறுத்தப்படலாம். வெளியீடு அனுமதிக்கப்படாதது என்று மதிப்பிடப்பட்டால், அது பயனரைச் சென்றடைவதற்கு முன் தடுக்கப்படும்.

குறியிடப்பட்ட செயல்பாடு, உள்ளடக்க தக்கவைப்பு மற்றும் மதிப்பாய்வு குறித்த எங்கள் விதிமுறைகள் மற்றும் கொள்கைகளுக்கு ஏற்ப, தொடர்புடைய உரையாடல்கள் மற்றும் ஆபத்து சிக்னல்கள் முழுவதும் கணக்கு-நிலை மதிப்பாய்வையும் தூண்டலாம். ஓர் உரையாடலைத் தாண்டிப் பார்ப்பது, ஒரே மாதிரியான தொழில்நுட்ப கருத்துகள் மிகவும் வேறுபட்ட சூழல்களில் தோன்றக்கூடிய இடங்களில், தொடர்ந்து நடக்கும் தீங்கிழைக்கும் நடத்தையையும் சட்டபூர்வ இரட்டை-பயன்பாட்டு பாதுகாப்புப் பணியையும் வேறுபடுத்த எங்கள் சிஸ்டங்களுக்கு உதவுகிறது.

இவை ஒன்றாகச் சேர்ந்தபோது, எந்த ஒரு பாதுகாப்பும் தனியாக வழங்குவதைக் காட்டிலும் மொத்த அணுகுமுறையை மேலும் வலிமையாக்குகின்றன. தீங்கான பதில்களின் சாத்தியத்தை மாடல் நடத்தை குறைக்கிறது; நேரடி சிஸ்டங்கள் உருவாக்கத்தின்போது தலையிட முடியும்; கணக்கு-நிலை மதிப்பாய்வு பரந்த வடிவங்களை அடையாளம் காண முடியும்; வேறுபடுத்தப்பட்ட அணுகல், மிக நுணுக்கமான திறன்களை இயல்பாக பரவலாகக் கிடைக்கச் செய்யாமல் முக்கியமான தற்காப்புப் பணியை பாதுகாக்கிறது.

குறிப்பாக முன்னோட்டத்தின்போது, சில கோரிக்கைகளைத் தடுக்கும் அல்லது மறுக்கும் பாதுகாப்புகளை பயனர்கள் சந்திக்கலாம். கூடுதல் மதிப்பாய்வுக்காக உருவாக்கம் இடைநிறுத்தப்படுவதால், பிற கோரிக்கைகளுக்கு அதிக நேரம் ஆகலாம். சட்டபூர்வ பணியிலும் பாதுகாப்புகள் சில நேரங்களில் தலையிடலாம்; குறிப்பாக தற்காப்பு மற்றும் தாக்குதல் செயல்பாடுகள் ஆரம்பத்தில் ஒன்றுபோல் தோன்றக்கூடிய இரட்டை-பயன்பாட்டு பகுதிகளில்.

முன்னோட்டம் சோதிக்க வடிவமைக்கப்பட்ட அம்சங்களில் இதுவும் ஒன்று. பாதுகாப்புகள் தவறான பயன்பாட்டை கட்டுப்படுத்துகிறதா என்பதையே அல்லாமல், சட்டபூர்வ பயனர்கள் வழக்கமான பணியை இன்னும் நம்பகமாகவும் திறமையாகவும் முடிக்க முடியுமா என்பதையும் புரிந்துகொள்ள விரும்புகிறோம். முன்னோட்டத்தின்போது கிடைக்கும் கருத்துகள், தேவையற்ற தடைகள் மற்றும் தாமதங்களை குறைக்கவும், பாதுகாப்புகள் சூழலை புரிந்துகொள்ளும் விதத்தை மேம்படுத்தவும், பரந்த வெளியீட்டிற்கு முன் மென்மையான அனுபவத்தை உருவாக்கவும் உதவும்.

நிறுவன தனியுரிமை தேவைகளை ஆதரித்தபடி பாதுகாப்பை முன்னேற்ற, தனியுரிமையைப் பாதுகாக்கும் கண்டறிதல், வாடிக்கையாளர் இயக்கும் பாதுகாப்புக் கட்டுப்பாடுகள், வாடிக்கையாளர், பயனர் அல்லது பணிச்சுமையின் ஆபத்துக்கு ஏற்ப ஒழுங்குபடுத்தப்பட்ட அணுகல் உள்ளிட்ட நீண்டகால அணுகுமுறைகளிலும் எண்டர்பிரைஸ் வாடிக்கையாளர்களுடன் பணியாற்றுகிறோம்.

தானியக்க ரெட்-டீமிங் மூலம் வலிமையை மேம்படுத்துதல்

தாக்குதலாளர்கள் தங்கள் உத்திகளை மாற்றிக்கொள்ளும்போதும் பாதுகாப்புகள் பயனுள்ளதாகவே இருக்க வேண்டும். அறியப்பட்ட தாக்குதல்களின் நிலையான தொகுப்பில் மட்டுமே செயல்படும் பாதுகாப்பு, ஒரு அதிநவீன மாடலுக்கு போதுமான அளவு வலிமையானது அல்ல.

அதனால்தான், பலவீனங்களை கண்டறிந்து பாதுகாப்புகளை வேகமாக மேம்படுத்த எங்கள் சொந்த மாடல்களைப் பயன்படுத்தி, முன்பெப்போதையும் விட அதிக நுண்ணறிவையும் கம்ப்யூட்டையும் பாதுகாப்பில் பயன்படுத்துகிறோம். ஒரு குறுகிய சூழலுக்கு மட்டுமல்லாமல் பல ப்ராம்ப்ட்கள் அல்லது சூழல்களிலும் செயல்படக்கூடிய யூனிவர்சல் ஜெயில்பிரேக்குகளை கண்டறிவதை நோக்கமாகக் கொண்ட தானியக்க ரெட்-டீமிங்கிற்கு, 700,000-க்கும் மேற்பட்ட A100-க்கு இணையான GPU மணிநேரங்களை ஒதுக்கினோம். இந்தக் கடினமான, பொதுவான தாக்குதல்களில் கவனம் செலுத்தியதால், அறியப்பட்ட தோல்விகளின் நிலையான தொகுப்பைத் தாண்டி பாதுகாப்புகளைச் சோதிக்க முடிந்தது. மனித சோதனை மட்டும் கையாள முடிவதை விட மிக அதிகமான தாக்குதல் வடிவங்களை ஆராயவும், தோல்வி முறைகளை முன்கூட்டியே கண்டறியவும், பலவீனத்தை கண்டுபிடிப்பதிலிருந்து அதைத் தீர்ப்பதற்கான பாதையைச் சுருக்கவும் இது உதவுகிறது.

தானியக்க ரெட்-டீமிங்குடன் கூடுதலாக, விரிவான மனித நிபுணர் ரெட்-டீமிங்கை நடத்த மூன்றாம் தரப்பு சோதனையாளர்களுடன் பணியாற்றினோம்; இது முன்னோட்டக் காலத்திலும் தொடரும். எங்கள் சிஸ்டங்கள் முன்கூட்டியே கணிக்காத வழிகளில் மாடலை தவறாகப் பயன்படுத்த முயலும் படைப்பாற்றலுள்ள நிபுணர்களுக்கு எதிராக பாதுகாப்புகளைச் சோதிப்பதன் மூலம், மனித ரெட்-டீமிங் தானியக்க பணியை நிரப்புகிறது.

எந்த மதிப்பீடும் ஒவ்வொரு தயாரிப்பு உள்ளமைவு, பல-படி தாக்குதல் அல்லது நிஜ உலக பணிப்பாய்வையும் பிரதிநிதித்துவப்படுத்த முடியாது. எனவே புதிதாக கண்டறியப்படும் ஜெயில்பிரேக்குகளை மீண்டும் உருவாக்க, மதிப்பிட, முன்னுரிமைப்படுத்த, சரிசெய்ய ஒரு விரைவு-பதில் செயல்முறையை வைத்திருக்கிறோம்; பின்னர் அவற்றை எங்கள் தொடர்ச்சியான மதிப்பீடுகளில் சேர்த்து, எதிர்காலத்தில் இதேபோன்ற தோல்விகளுக்கு எதிராகச் சோதிக்கிறோம்.

கிடைக்குமிடம் மற்றும் விலை நிர்ணயம்

முன்னோட்டத்தின்போது, GPT‑5.6 மாடல்கள் ஆரம்பத்தில் API மற்றும் Codex வழியாக, நம்பகமான சில கூட்டாளர்கள் மற்றும் நிறுவனங்களுக்கு கிடைக்கும். ChatGPT, Codex மற்றும் API-ஐ பயன்படுத்தும் மக்களுக்கு அவற்றை விரைவில் மேலும் பரவலாகக் கிடைக்கச் செய்ய திட்டமிட்டுள்ளோம்.

GPT‑5.6 உடன் அறிமுகப்படுத்தப்பட்ட இந்த புதிய பெயரிடும் சிஸ்டத்தில், எண் ஒரு மாடலின் தலைமுறையை குறிக்கிறது; Sol, Terra, Luna ஆகியவை தங்கள் சொந்த வேகத்தில் முன்னேறக்கூடிய நிலையான திறன் அடுக்குகளை குறிக்கின்றன. மொத்தமாக, மக்களுக்கும் டெவலப்பர்களுக்கும் நுண்ணறிவு, வேகம், செலவு ஆகியவற்றில் தெளிவான தேர்வுகளை இந்த குடும்பம் வழங்குகிறது.

GPT‑5.6 மூன்று மாடல் அளவுகளில் 1M டோக்கன்களுக்கு விலை நிர்ணயிக்கப்பட்டுள்ளது: Sol $5 உள்ளீடு / $30 வெளியீடு; Terra $2.50 உள்ளீடு / $15 வெளியீடு; Luna $1 உள்ளீடு / $6 வெளியீடு. GPT‑5.6 மேலும் கணிக்கத்தக்க ப்ராம்ப்ட் கேச்சிங்கையும் அறிமுகப்படுத்துகிறது; இதில் வெளிப்படையான கேச் பிரேக்பாயிண்ட்களுக்கான ஆதரவும் 30 நிமிட குறைந்தபட்ச கேச் ஆயுளும் அடங்கும். GPT‑5.6 மற்றும் அதன் பிந்தைய மாடல்களுக்கு, கேச் எழுதுதல்கள் மாடலின் கேச் செய்யப்படாத உள்ளீட்டு விகிதத்தின் 1.25x-ஆக பில் செய்யப்படும்; கேச் வாசிப்புகளுக்கு 90% கேஷ் செய்யப்பட்ட-உள்ளீட்டு தள்ளுபடி தொடர்ந்து கிடைக்கும்.

ஜூலை மாதத்தில் Cerebras-இல் GPT‑5.6 Sol-ஐ வினாடிக்கு 750 டோக்கன்கள் வரை வேகத்தில் அறிமுகப்படுத்துகிறோம்; இதன் மூலம் அதிநவீன நுண்ணறிவை வாடிக்கையாளர்களுக்கு முன்னெப்போதுமில்லாத வேகத்தில் கொண்டு வருகிறோம். திறனை விரிவுபடுத்தும் வரை, அணுகல் ஆரம்பத்தில் தேர்ந்தெடுக்கப்பட்ட வாடிக்கையாளர்களுக்கு மட்டுமே வழங்கப்படும்.

இந்த முன்னோட்டக் காலத்திலிருந்து தொடர்ந்து கற்றுக்கொள்வதிலும், GPT‑5.6 Sol, Terra மற்றும் Luna-ஐ விரைவில் மேலும் பலரிடம் கொண்டு செல்வதிலும் நாங்கள் உற்சாகமாக உள்ளோம்.


1. எங்கள் மாடல்களின் தயாரிப்பு சூழல் நடத்தையைப் பார்த்தும், ஆஃப்லைனில் உருவகப்படுத்தியும் தாமதம் மற்றும் API செலவை மதிப்பிடுகிறோம். கருவி அழைப்பு விவரங்கள், மாதிரியாக எடுக்கப்பட்ட டோக்கன்கள், உள்ளீட்டு டோக்கன்கள் ஆகியவற்றை இந்த மதிப்பீடுகள் கணக்கில் கொள்கின்றன. நிஜ உலக முடிவுகள் குறிப்பிடத்தக்க அளவில் மாறக்கூடும்; எங்கள் உருவகப்படுத்தலில் பதிவாகாத பல காரணிகளையும் அவை சார்ந்திருக்கும். வேகமான API வேகங்களில் தாமதத்தையும், வழக்கமான API விலை நிர்ணயத்தில் செலவையும் உருவகப்படுத்துகிறோம்.

2. அனைத்து மாடல்களும் 5 தொடக்க மதிப்புகள் மற்றும் ரீஸனிங் தொடர்ச்சியுடன் ExploitBench API சூழல் பணி அமைவை பயன்படுத்தி மதிப்பிடப்படுகின்றன.

3. எங்கள் பொது API-ஐ விட வேகமாக பதில்களை வெளியிடும் எங்கள் alpha API-இல் ExploitGym-ஐ இயக்கினோம்; பின்னர் எங்கள் பொது API-க்கு பொருந்துமாறு மாற்றியமைத்தோம். எங்கள் பொது API-க்கு எதிர்பார்க்கப்படும் வேகங்களுக்கு தாமதங்களை மாற்றியமைக்கும்போது, மதிப்பீட்டு இயக்கத்தில் சரியாகக் கடைபிடிக்கப்பட்டிருந்தாலும், சில மதிப்பிடப்பட்ட தாமதங்கள் 2 மணி மற்றும் 6 மணி நேர வரம்புகளைத் தாண்டுகின்றன. நேர உணர்வுள்ள பணிகளுக்கு அதிக வேகம் பெற, API-இல் முன்னுரிமைச் செயலாக்கத்தையும்⁠ Codex-இல் விரைவுப் பயன்முறையையும்⁠ வழங்குகிறோம்.

4. வெளியீட்டு டோக்கன்கள், தாமதம் அல்லது செலவு தெரிவிக்கப்படாத மாடல்கள் கிடைமட்ட புள்ளிக் கோடுகளாக வரைபடத்தில் காட்டப்படுகின்றன.

ஆசிரியர்

OpenAI