మేము GPT‑5.6 సిరీస్కు పరిమిత ప్రివ్యూను ప్రారంభిస్తున్నాం: మా ఫ్లాగ్షిప్ మోడల్ Sol; రోజువారీ పనికి సమతుల్య మోడల్ Terra; వేగవంతమైన, అందుబాటు ధరలో ఉండే మోడల్ Luna. Terra, GPT‑5.5తో పోటీ పడగల పనితీరును ఇస్తూనే 2x చౌకగా ఉంటుంది; Luna మా అత్యల్ప ఖర్చుతో బలమైన సామర్థ్యాన్ని అందిస్తుంది.
GPT‑5.6 Sol ఇప్పటివరకు మా అత్యంత దృఢమైన భద్రతా స్టాక్తో ప్రారంభమవుతోంది. అధిక-ప్రమాద కార్యకలాపాలు, సున్నితమైన సైబర్ అభ్యర్థనలు, పునరావృత దుర్వినియోగం కోసం మేము రక్షణలను బలోపేతం చేశాం; బలహీనతలను కనుగొనడం, మా సిస్టమ్ను ఒత్తిడిలో పరీక్షించడం, వాస్తవ ప్రపంచ దాడులకు ఎదురునిలిచేలా దాన్ని గట్టిపరచడం కోసం అనేక వారాలు ఖర్చు చేశాం.
విస్తృత యాక్సెస్ను మేము విశ్వసిస్తున్నాం; రాబోయే వారాల్లో GPT‑5.6 Sol, Terra, Lunaలను సాధారణంగా అందుబాటులోకి తేవాలని యోచిస్తున్నాం. U.S. ప్రభుత్వంతో మా కొనసాగుతున్న భాగస్వామ్యంలో భాగంగా, నేటి ప్రారంభానికి ముందు మా ప్రణాళికలు మరియు మోడల్ల సామర్థ్యాల ప్రివ్యూను అందించాం. వారి అభ్యర్థన మేరకు, విస్తృతంగా విడుదల చేసే ముందు, ప్రభుత్వంతో పంచుకున్న పాల్గొనిక కలిగిన చిన్న సమూహం నమ్మకమైన భాగస్వాములతో పరిమిత ప్రివ్యూను ప్రారంభిస్తున్నాం. ఈ ప్రివ్యూ సమయంలో, విస్తృత లభ్యత దిశగా పనిచేస్తూ మేము పరీక్షలను కొనసాగిస్తాం మరియు భాగస్వాములతో సన్నిహితంగా సమన్వయం చేస్తాం. ఇలాంటి ప్రభుత్వ యాక్సెస్ ప్రక్రియ దీర్ఘకాలిక డిఫాల్ట్గా మారాలని మేము నమ్మడం లేదు. అవి అవసరమైన యూజర్లు, డెవలపర్లు, సంస్థలు, సైబర్ రక్షకులు, గ్లోబల్ భాగస్వాములకు ఉత్తమ టూల్లు చేరకుండా ఇది అడ్డుకుంటుంది. రాబోయే వారాల్లో విస్తృత లభ్యతకు ఇదే బలమైన మార్గమని మేము భావిస్తున్నందున ఈ స్వల్పకాలిక చర్య తీసుకుంటున్నాం; ఇదే సమయంలో సైబర్ ఎగ్జిక్యూటివ్ ఆర్డర్ ఫ్రేమ్వర్క్ మరియు భవిష్యత్ మోడల్ విడుదలల కోసం పునరావృతం చేయగల ప్రక్రియను అభివృద్ధి చేయడానికి అడ్మినిస్ట్రేషన్తో కలిసి పనిచేస్తున్నాం.
GPT‑5.6 Sol ఇప్పటివరకు మా అత్యంత బలమైన మోడల్. మోడల్ పనితీరు ప్రివ్యూను ఇవ్వడానికి, కోడింగ్, బయాలజీ, సైబర్సెక్యూరిటీలో మెరుగైన ఏజెంట్-ఆధారిత సామర్థ్యాలను చూపించే మూల్యాంకనాల సమితిని మేము పంచుకుంటున్నాం; అదనపు భద్రత మరియు సిద్ధత మూల్యాంకనాలు మా సిస్టమ్ కార్డ్(కొత్త విండోలో తెరుచుకుంటుంది)లో అందుబాటులో ఉన్నాయి. మోడల్ను విస్తృతంగా అందుబాటులోకి తెచ్చినప్పుడు, మరింత విస్తృతమైన మూల్యాంకన ఫలితాల సమాహారాన్ని మేము పంచుకుంటాం.
GPT‑5.6తో, Solకు లోతుగా రీజన్ చేయడానికి అత్యధిక సమయం ఇవ్వేందుకు కొత్త `max` రీజనింగ్ శ్రమను పరిచయం చేస్తున్నాం. అదనంగా, క్లిష్టమైన పనిని వేగవంతం చేయడానికి సబ్ఏజెంట్లను ఉపయోగించడం ద్వారా ఒకే ఏజెంట్ సామర్థ్యాలకు మించి వెళ్లే కొత్త `ultra` మోడ్ను పరిచయం చేస్తున్నాం.
కోడింగ్ వర్క్ఫ్లోల కోసం, ప్రణాళిక, పునరావృతం, టూల్ సమన్వయం అవసరమైన కమాండ్-లైన్ వర్క్ఫ్లోలను పరీక్షించే Terminal‑Bench 2.1లో GPT‑5.6 Sol కొత్త అత్యాధునిక ప్రమాణాన్ని నెలకొల్పుతుంది.
GPT‑5.6 Sol బయాలజీ వర్క్ఫ్లోలలో కూడా విస్తృత మెరుగుదలలను చూపిస్తుంది. దీర్ఘకాలిక జనోమిక్స్ మరియు పరిమాణాత్మక-బయాలజీ విశ్లేషణలను మూల్యాంకనం చేసే GeneBench v1లో, ఇది తక్కువ టోకెన్లను ఉపయోగిస్తూ GPT‑5.5 కంటే బలమైన ఫలితాలను సాధిస్తుంది.
GPT‑5.6 Sol సైబర్సెక్యూరిటీ కోసం ఇప్పటివరకు మా అత్యంత సామర్థ్యవంతమైన మోడల్. వల్నరబిలిటీ పరిశోధన మరియు ఎక్స్ప్లాయిటేషన్తో సహా దీర్ఘకాలిక భద్రతా పనుల కోసం ఇది పనితీరు-సమర్థత సరిహద్దును ముందుకు నెడుతుంది. ExploitBench²లో, GPT‑5.6 Sol కేవలం ~1/3 అవుట్పుట్ టోకెన్లను మాత్రమే ఉపయోగించి Mythos Previewతో పోటీ పడగల స్థాయిలో ఉంది. OpenAI మరియు ఇతర ఫ్రంటియర్ ల్యాబ్లతో కలిసి UC Berkeley పరిశోధకులు రూపొందించిన బెంచ్మార్క్ అయిన ExploitGym(కొత్త విండోలో తెరుచుకుంటుంది)3లో, రీజనింగ్ను పెంచుతున్నప్పుడు GPT‑5.6 Sol, Terra, Luna మోడల్లన్నీ సైబర్ సామర్థ్యాల్లో బలమైన మెరుగుదలలను చూపిస్తున్నాయి.
ప్రతి మోడల్ సామర్థ్యాలకు సరిపోయే కాన్ఫిగరేషన్లతో, ఇప్పటివరకు మా అత్యంత దృఢమైన రక్షణలతో GPT‑5.6 Sol, Terra, Lunaలను మేము అభివృద్ధి చేశాం. మోడల్ మరింత సామర్థ్యవంతమవుతున్న కొద్దీ, కోడ్ రివ్యూ, వల్నరబిలిటీ పరిశోధన, ప్యాచ్ అభివృద్ధి, డీబగ్గింగ్, భద్రతా విద్య, రక్షణాత్మక పరీక్షల వంటి చట్టబద్ధమైన పనులకు యాక్సెస్ను కాపాడుతూ, వాస్తవ ప్రపంచ ప్రతికూల ఒత్తిడికి రక్షణలు మరింతగా నిలబడేలా మేము వాటిని రూపొందిస్తాం. ప్రయోజనకరమైన ఆ వినియోగాలను అవసరం లేకుండా పరిమితం చేయకుండా, నిషేధిత దాడి కార్యకలాపాన్ని మరింత కష్టంగా, అనిశ్చితంగా, గుర్తించదగినదిగా చేయడం మా లక్ష్యం. మోడల్ మరియు రక్షణలపై మా అంచనాల ఆధారంగా, నిషేధిత దాడి వినియోగాన్ని గణనీయంగా నియంత్రిస్తూ, చట్టబద్ధమైన రక్షణాత్మక పనికి గణనీయమైన ప్రయోజనం కలుగుతుందని మేము భావిస్తున్నాం.
ఎండ్-టు-ఎండ్ దాడులను నమ్మకంగా నిర్వహించడంకన్నా, వల్నరబిలిటీలను కనుగొని పరిష్కరించడంలో ప్రజలకు సహాయం చేయడంలో GPT‑5.6 Sol మెరుగ్గా ఉంటుంది. ఈ సామర్థ్యాలు ముందుకు సాగుతూనే ఉన్నప్పుడు, బలహీనతలను కనుగొనడానికి, ప్యాచ్లను అభివృద్ధి చేయడానికి, వ్యవస్థలను విస్తృతంగా బలోపేతం చేయడానికి ఈ టూల్లను ఉపయోగించగల రక్షకులకు అవి చేరి ప్రయోజనం కలిగేలా చూడడం మా ప్రాధాన్యం.
GPT‑5.6 Sol మా Preparedness Frameworkలోని Cyber Critical థ్రెషోల్డ్ను దాటదు. Chromium మరియు Firefoxకు సంబంధించిన మూల్యాంకనాల్లో, ఇది బగ్లు మరియు ఎక్స్ప్లాయిటేషన్ ప్రిమిటివ్లను—ఎక్స్ప్లాయిట్ నిర్మాణ భాగాలను—గుర్తించింది; కానీ పరీక్షించిన పరిస్థితుల్లో స్వయంచాలకంగా పనిచేసే పూర్తి-చైన్ ఎక్స్ప్లాయిట్ను తయారు చేయలేదు. అయినా, బెంచ్మార్క్ థ్రెషోల్డ్లు మోడల్ను ఉపయోగించే లేదా ఇతర టూల్లతో కలిపే ప్రతి విధానాన్ని పట్టుకోలేవు. ఆ అనిశ్చితి, అలాగే మోడల్ సామర్థ్యాల్లోని విస్తృత దశ మార్పు కారణంగానే, మోడల్ పెరిగిన సామర్థ్యాలను బలమైన రక్షణలు మరియు దశలవారీ విడుదలతో జత చేస్తున్నాం. మా రక్షణల గురించి మరిన్ని వివరాలను GPT‑5.6 Preview సిస్టమ్ కార్డ్(కొత్త విండోలో తెరుచుకుంటుంది)లో పంచుకుంటాం.
దృఢ సంకల్పంతో లేదా అనుకూలంగా మారే దుర్వినియోగానికి వ్యతిరేకంగా ఒక్క రక్షణ సరిపోదు. GPT‑5.6 ప్రివ్యూ అంతటా, మోడల్లవారీగా ఖచ్చితమైన కాన్ఫిగరేషన్లు మారే పొరలతో కూడిన రక్షణలను మేము ఉపయోగిస్తాం, అలాగే వాస్తవ ప్రపంచ దాడుల కోసం వాటిని ఒత్తిడిలో పరీక్షిస్తాం. ఇవిలో మోడల్లో శిక్షణ ఇచ్చిన రక్షణలు, జనరేషన్ సమయంలో రియల్-టైమ్ తనిఖీలు, ఖాతా-స్థాయి సంకేతాలు, వేర్వేరు యాక్సెస్, మానిటరింగ్, అమలు చర్యలు, కొనసాగుతున్న పరీక్షలు ఉన్నాయి.
యూజర్లు తమ ఉద్దేశాన్ని దాచడానికి లేదా మోడల్ను జైల్బ్రేక్ చేయడానికి ప్రయత్నించినప్పటికీ, నిషేధిత సైబర్ సహాయాన్ని తిరస్కరించేలా GPT‑5.6కు శిక్షణ ఇచ్చారు. మోడల్ ఏమి సహాయపడాలి, ఏమి సహాయపడకూడదు అన్న దానిపై ఈ మోడల్-స్థాయి రక్షణలు మొదటి సరిహద్దును ఏర్పరుస్తాయి.
రియల్-టైమ్ సైబర్ మరియు బయాలజీ దుర్వినియోగ క్లాసిఫయర్లు, అవుట్పుట్ జనరేట్ అవుతున్నప్పుడే దానిని మూల్యాంకనం చేసి మరో పొరను అందిస్తాయి. అధిక ప్రమాద సందర్భాల్లో, అవి సంభావ్య ఉల్లంఘనను గుర్తిస్తే, పెద్ద రీజనింగ్ మోడల్ సంభాషణను మరియు దాని సందర్భాన్ని సమీక్షించే వరకు జనరేషన్ నిలిపివేయబడవచ్చు. అవుట్పుట్ అనుమతించబడదని అంచనా వేస్తే, అది యూజర్కు చేరే ముందు నిలిపివేయబడుతుంది.
ఫ్లాగ్ చేసిన కార్యకలాపం, కంటెంట్ నిల్వ మరియు సమీక్షకు సంబంధించిన మా నిబంధనలు, విధానాలకు అనుగుణంగా, సంబంధిత సంభాషణలు మరియు ప్రమాద సంకేతాల వ్యాప్తంగా ఖాతా-స్థాయి సమీక్షను కూడా ప్రారంభించవచ్చు. ఒకే సంభాషణను దాటి చూడడం వల్ల, ఒకేలా కనిపించే సాంకేతిక భావనలు చాలా భిన్న సందర్భాల్లో కనిపించే చట్టబద్ధమైన ద్వంద్వ-వినియోగ భద్రతా పనితో, నిరంతర హానికర ప్రవర్తనను మా సిస్టమ్లు వేరు చేయగలవు.
ఈ పొరలన్నీ కలిసి, ఒక్కో రక్షణ ఒంటరిగా ఇచ్చేదానికంటే మొత్తం విధానాన్ని మరింత దృఢంగా చేస్తాయి. మోడల్ ప్రవర్తన హానికర స్పందనల అవకాశాన్ని తగ్గిస్తుంది; రియల్-టైమ్ సిస్టమ్లు జనరేషన్ సమయంలో జోక్యం చేసుకోగలవు; ఖాతా-స్థాయి సమీక్ష విస్తృత నమూనాలను గుర్తించగలదు; వేర్వేరు యాక్సెస్, అత్యంత సున్నితమైన సామర్థ్యాలను డిఫాల్ట్గా విస్తృతంగా అందుబాటులో పెట్టకుండా ముఖ్యమైన రక్షణాత్మక పనిని కాపాడుతుంది.
ప్రత్యేకంగా ప్రివ్యూ సమయంలో, కొన్ని అభ్యర్థనలను బ్లాక్ చేసే లేదా తిరస్కరించే రక్షణలను యూజర్లు ఎదుర్కొనవచ్చు. అదనపు సమీక్ష కోసం జనరేషన్ నిలిపివేయబడినందున, ఇతర అభ్యర్థనలకు ఎక్కువ సమయం పట్టవచ్చు. రక్షణాత్మక మరియు దాడి కార్యకలాపాలు ప్రారంభంలో ఒకేలా కనిపించగల ద్వంద్వ-వినియోగ రంగాల్లో, చట్టబద్ధమైన పనిపైనా రక్షణలు అప్పుడప్పుడు జోక్యం చేసుకోవచ్చు.
ప్రివ్యూ పరీక్షించడానికి రూపొందించబడిన అంశాల్లో అది కూడా ఒకటి. రక్షణలు దుర్వినియోగాన్ని నియంత్రిస్తున్నాయా అన్నదే కాకుండా, చట్టబద్ధమైన యూజర్లు సాధారణ పనిని ఇప్పటికీ నమ్మకంగా, సమర్థంగా పూర్తి చేయగలరా అన్నదీ మేము అర్థం చేసుకోవాలనుకుంటున్నాం. ప్రివ్యూ సమయంలో వచ్చే ఫీడ్బ్యాక్, అవసరం లేని బ్లాక్లు మరియు ఆలస్యాలను తగ్గించడానికి, రక్షణలు సందర్భాన్ని అర్థం చేసుకునే విధానాన్ని మెరుగుపరచడానికి, విస్తృత విడుదలకు ముందు మరింత సుగమమైన అనుభవాన్ని సృష్టించడానికి మాకు సహాయపడుతుంది.
ఎంటర్ప్రైజ్ గోప్యతా అవసరాలకు మద్దతు ఇస్తూనే భద్రతను ముందుకు తీసుకెళ్లడానికి, గోప్యతను కాపాడే గుర్తింపు, కస్టమర్ నిర్వహించే భద్రతా నియంత్రణలు, కస్టమర్, యూజర్ లేదా వర్క్లోడ్ ప్రమాదానికి అనుగుణంగా సర్దుబాటు చేసిన యాక్సెస్ వంటి దీర్ఘకాలిక విధానాలపై కూడా మేము ఎంటర్ప్రైజ్ కస్టమర్లతో కలిసి పనిచేస్తున్నాం.
దాడి చేసేవారు తమ వ్యూహాలను మార్చుకున్నప్పటికీ రక్షణలు ప్రభావవంతంగానే ఉండాలి. తెలిసిన దాడుల స్థిర సమితిపై మాత్రమే పనిచేసే రక్షణ ఒక ఫ్రంటియర్ మోడల్కు సరిపడా దృఢంగా ఉండదు.
అందుకే బలహీనతలను కనుగొని రక్షణలను వేగంగా మెరుగుపరచడానికి మా స్వంత మోడల్లను ఉపయోగిస్తూ, భద్రత కోసం మునుపెన్నడూ లేనంతగా ఇంటెలిజెన్స్ మరియు కంప్యూట్ను వినియోగిస్తున్నాం. యూనివర్సల్ జైల్బ్రేక్లను కనుగొనడమే లక్ష్యంగా ఉన్న ఆటోమేటెడ్ రెడ్ టీమింగ్కు మేము 700,000కు పైగా A100-సమాన GPU గంటలను కేటాయించాం: అంటే ఒకే సంకుచిత సందర్భంలో కాకుండా, అనేక ప్రాంప్ట్లు లేదా సందర్భాల్లో పనిచేయగల దాడులు. ఇలాంటి మరింత కఠినమైన, సాధారణ దాడులపై దృష్టి పెట్టడం వల్ల, తెలిసిన వైఫల్యాల స్థిర సమితిని దాటి రక్షణలను పరీక్షించగలిగాం. దీంతో మానవ పరీక్షలతో మాత్రమే సాధ్యమయ్యేదానికంటే ఎన్నో రెట్లు ఎక్కువ దాడి నమూనాలను పరిశీలించడం, వైఫల్య నమూనాలను ముందుగానే గుర్తించడం, బలహీనతను కనుగొనడం నుంచి దాన్ని పరిష్కరించేవరకు తీసుకునే సమయాన్ని తగ్గించడం సాధ్యమవుతుంది.
ఆటోమేటెడ్ రెడ్-టీమింగ్తో పాటు, మేము థర్డ్-పార్టీ టెస్టర్లతో కలిసి విస్తృత మానవ నిపుణుల రెడ్ టీమింగ్ను నిర్వహించాం; ఇది ప్రివ్యూ కాలంలో కొనసాగుతుంది. మా సిస్టమ్లు ముందుగా ఊహించకపోవచ్చిన విధాలుగా మోడల్ను దుర్వినియోగం చేయడానికి ప్రయత్నించే సృజనాత్మక నిపుణులపై రక్షణలను పరీక్షించడం ద్వారా, మానవ రెడ్-టీమింగ్ ఆటోమేటెడ్ పనికి పూరకంగా ఉంటుంది.
ఏ మూల్యాంకనమూ ప్రతి ఉత్పత్తి కాన్ఫిగరేషన్ను, బహుళ-దశల దాడిని లేదా వాస్తవ ప్రపంచ వర్క్ఫ్లోను ప్రతినిధ్యం చేయలేడు. కాబట్టి కొత్తగా కనుగొన్న జైల్బ్రేక్లను పునరుత్పత్తి చేయడం, అంచనా వేయడం, ప్రాధాన్యం కేటాయించడం, పరిష్కరించడం కోసం మేము వేగవంతమైన ప్రతిస్పందన ప్రక్రియను కొనసాగిస్తాం; తరువాత వాటిని మా కొనసాగుతున్న మూల్యాంకనాల్లో చేర్చి, భవిష్యత్తులో ఇలాంటి వైఫల్యాలపై పరీక్షించగలుగుతాం.
ప్రివ్యూ సమయంలో, GPT‑5.6 మోడల్లు ప్రారంభంలో API మరియు Codex ద్వారా ఎంపిక చేసిన నమ్మకమైన భాగస్వాములు, సంస్థలకు అందుబాటులో ఉంటాయి. ChatGPT, Codex, APIలను ఉపయోగించే మరింత ఎక్కువ మంది వ్యక్తులకు త్వరలో వీటిని విస్తృతంగా అందుబాటులోకి తేవాలని మేము యోచిస్తున్నాం.
GPT‑5.6తో పరిచయం చేసిన ఈ కొత్త నామకరణ వ్యవస్థలో, సంఖ్య మోడల్ తరాన్ని సూచిస్తుంది; Sol, Terra, Luna మాత్రం తమ స్వంత గమనంలో ముందుకు సాగగల స్థిర సామర్థ్య శ్రేణులను సూచిస్తాయి. మొత్తంగా ఈ కుటుంబం, వ్యక్తులు మరియు డెవలపర్లకు ఇంటెలిజెన్స్, వేగం, ఖర్చు పరంగా మరింత స్పష్టమైన ఎంపికలను ఇస్తుంది.
GPT‑5.6 ధర మూడు మోడల్ పరిమాణాల్లో ప్రతి 1M టోకెన్లకు ఇలా ఉంటుంది: Sol ఇన్పుట్ $5 / అవుట్పుట్ $30; Terra ఇన్పుట్ $2.50 / అవుట్పుట్ $15; Luna ఇన్పుట్ $1 / అవుట్పుట్ $6. GPT‑5.6 మరింత అంచనా వేయగల ప్రాంప్ట్ క్యాషింగ్ను కూడా పరిచయం చేస్తోంది; ఇందులో స్పష్టమైన క్యాష్ బ్రేక్పాయింట్లకు మద్దతు మరియు కనీసం 30 నిమిషాల క్యాష్ జీవితం ఉన్నాయి. GPT‑5.6 మరియు తదుపరి మోడల్లకు, క్యాష్ రైట్లకు మోడల్ అన్క్యాష్డ్ ఇన్పుట్ రేటుకు 1.25xగా బిల్లు చేయబడుతుంది; క్యాష్ రీడ్లకు మాత్రం 90% క్యాష్డ్-ఇన్పుట్ డిస్కౌంట్ కొనసాగుతుంది.
జూలైలో Cerebrasపై సెకనుకు 750 టోకెన్ల వరకు వేగంతో GPT‑5.6 Solను కూడా ప్రారంభిస్తున్నాం; దీనితో వినియోగదారులకు ఫ్రంటియర్ ఇంటెలిజెన్స్ను అపూర్వ వేగంతో అందిస్తున్నాం. సామర్థ్యాన్ని విస్తరించే వరకు యాక్సెస్ ప్రారంభంలో ఎంపిక చేసిన కస్టమర్లకే పరిమితం అవుతుంది.
ఈ ప్రివ్యూ కాలం నుంచి నేర్చుకుంటూ, GPT‑5.6 Sol, Terra, Lunaలను త్వరలో మరింత ఎక్కువ మందికి అందించడానికి మేము ఆసక్తిగా ఉన్నాం.
1. మా మోడల్ల ఉత్పత్తి ప్రవర్తనను పరిశీలించి, ఆఫ్లైన్లో సిమ్యులేట్ చేసి లేటెన్సీ మరియు API ఖర్చును మేము అంచనా వేస్తాం. ఈ అంచనాలు టూల్ కాల్ వివరాలు, నమూనా తీసిన టోకెన్లు, ఇన్పుట్ టోకెన్లను పరిగణనలోకి తీసుకుంటాయి. వాస్తవ ప్రపంచ ఫలితాలు గణనీయంగా మారవచ్చు; మా సిమ్యులేషన్లో పట్టని అనేక అంశాలపై ఆధారపడతాయి. మేము వేగవంతమైన API వేగాల్లో లేటెన్సీని, సాధారణ API ధరల వద్ద ఖర్చును సిమ్యులేట్ చేస్తాం.
2. అన్ని మోడల్లు 5 సీడ్లు మరియు రీజనింగ్ కంటిన్యుటీతో ExploitBench API హార్నెస్ను ఉపయోగించి మూల్యాంకనం చేయబడ్డాయి.
3. మా పబ్లిక్ API కంటే వేగంగా స్పందనలను అవుట్పుట్ చేసే మా ఆల్ఫా APIపై ExploitGymను అమలు చేసి, తరువాత మా పబ్లిక్ APIకి సరిపోలేలా మళ్లీ స్కేల్ చేశాం. మా పబ్లిక్ APIకి ఆశించే వేగాలకు లేటెన్సీలను మళ్లీ స్కేల్ చేసినప్పుడు, మూల్యాంకన రన్లో అవి సరిగ్గా పాటించబడినప్పటికీ, కొన్ని అంచనా లేటెన్సీలు 2గం మరియు 6గం సమయ పరిమితులను మించిపోయేలా ఇది చేస్తుంది. సమయస్పందన ముఖ్యమైన పనికి ఎక్కువ వేగం పొందడానికి, APIలో priority processing మరియు Codexలో fast mode అందిస్తున్నాం.
4. నివేదించిన అవుట్పుట్ టోకెన్లు, లేటెన్సీ లేదా ఖర్చు లేని మోడల్లు అడ్డంగా ఉన్న చుక్కల రేఖలుగా చూపబడతాయి.

