Mwongozo wa waundaji kuhusu GPT‑5.6
Mafunzo ya kiufundi kutoka kwa kampuni changa katika uzalishaji
Familia ya miundo ya GPT‑5.6 inapunguza sana gharama ya kupata utendaji wa mawakala wa kiwango cha juu zaidi, huku pia ikipanua kiwango cha juu zaidi cha mambo yanayowezekana.
Katika mwongozo huu, tunaonyesha jinsi kampuni changa zinavyotumia uteuzi bora wa miundo na vidhibiti vipya vya API vinavyosaidia kudumisha mwendelezo wa uwazaji, kuratibu mawakala wengi na kuita zana kwa programu ili kuunda mawakala wenye kasi na uwezo zaidi kwa sehemu ndogo ya gharama.
Tangu GPT‑5, kila kizazi cha miundo kimejaribu kushughulikia kazi za muda mrefu kwa tokeni chache zaidi. GPT‑5.6 inaendeleza mwelekeo huo: utendaji bora wa mawakala na gharama za chini, huku ikihitaji mabadiliko machache sana kwenye mazingira ya uendeshaji ya msingi.
Manufaa makubwa ya ufanisi wa gharama yanaongezwa na usahihi zaidi hata kwa kiwango cha chini cha uwazaji. Kwa mfano, kwenye Agents’ Last Exam, GPT‑5.6 Sol kwa uwazaji wa kiwango cha “chini” ilifanya vizuri kuliko GPT‑5.5 kwa uwazaji wa kiwango cha “juu” huku mazingira ya uendeshaji yakibaki yaleyale. Tumeona mafanikio kama hayo katika majaribio ya uzalishaji, ambapo kampuni changa zimeripoti kupunguza gharama kwa kiasi kikubwa katika mitiririko mbalimbali ya kazi kwa kushusha kiwango cha uwazaji kutoka kwenye mipangilio-msingi ya awali.
Kihistoria, kuhamia kwenye muundo mkuu unaotumia kiwango cha juu zaidi cha uwazaji kumekuwa chaguo bora kwa matumizi ya muda mrefu. Sababu kuu ni kwamba miundo hii imekuwa na uwezo mkubwa zaidi kuliko miundo iliyoboreshwa kwa gharama katika kushughulikia miktadha mirefu na uitaji wa zana. Hali hii imebadilika katika familia ya 5.6: kwa rasilimali zaidi za ukokotoaji wakati wa majaribio, Luna na Terra mara nyingi zinaweza kufanya kazi sawa na GPT‑5.4 na 5.5 huku zikiwa nafuu zaidi.
Fikiria kazi za BrowseComp, kipimo linganishi kinachotegemea utafutaji na kupima uwezo wa muundo kutafuta taarifa zisizojulikana sana. Miezi mitatu iliyopita, GPT‑5.5 (Juu Sana) ilipata 84.36% kwenye kipimo hiki kwa jumla ya gharama ya $33.27. Wakati wa uzinduzi, GPT‑5.6 Luna (Juu Sana) inatoa karibu utendaji uleule, ikipata 84.04% kwa gharama ya $1.33. Tangu wakati huo, tumepunguza bei hata zaidi. Soma zaidi kuhusu punguzo letu la hivi karibuni la bei.
Miundo midogo ya familia ya 5.6 inafaa sana kwa kazi zenye ujazo mkubwa, miamala inayohitaji mwitikio wa haraka na hatua zinazorudiwa katika mitiririko ya kazi ya mawakala. Kwa mfano, ikiwa unaendesha kampuni changa ya teknolojia ya sheria inayochanganua memo zilizoandikwa kwa mkono kabla ya uchanganuzi wa wakala, sasa unaweza kutumia Terra au Luna kuchopoa taarifa na kuokoa gharama nyingi badala ya kutumia muundo wa kiwango cha juu zaidil katika mchakato mzima.
Mbali na kuboresha utendaji wa GPT‑5.6 moja kwa moja bila usanidi wa ziada, pia tuliongeza vipengele vipya vya msingi kwenye Responses API ili kuleta manufaa zaidi. Tulifunza GPT‑5.6 kuanzia mwanzo hadi mwisho kwa kutumia maboresho matatu ya usanifu yanayokamilishana na kuwawezesha mawakala kufanya kazi kwa ufanisi zaidi:
- Tumia tena kazi iliyofanywa: kwa kuwezesha uwazaji kuhifadhiwa(fungua katika dirisha jipya) katika zamu mbalimbali za muundo na kutumia ukandamizaji wa mutadha asilia(fungua katika dirisha jipya) kufupisha mazungumzo ya muda mrefu, muundo unaweza kudumisha mtiririko thabiti wa kazi katika vipindi virefu bila kuchanganyikiwa au kulazimika kuunda upya muktadha wa awali.
- Gawanya kazi sambamba inapofaa: kutumia uratibu asilia wa mawakala wengi(fungua katika dirisha jipya) huwezesha mawakala wengi kuratibiwa katika mikondo sambamba ya kazi ili kukamilisha kazi tata kwa haraka zaidi.
- Hamishia kazi yenye matokeo thabiti kwenye msimbo: kutumia uitaji wa zana kwa programu(fungua katika dirisha jipya) kuchuja, kujumlisha na kuratibu matokeo ya zana nje ya dirisha la muktadha la muundo huacha tokeni za muundo zitumike kufanya maamuzi, huku ikipunguza gharama, muda wa kusubiri na kuzorota kwa muktadha.
Vikitumiwa pamoja, vipengele hivi vinaweza kuleta tofauti kubwa. Kwa mfano, kwenye ARC-AGI-3, GPT‑5.6 Sol ilipata 13.3% kwa kutumia mazingira ya kawaida ya uendeshaji. Hata hivyo, baada ya kuwasha uhifadhi wa uwazaji na ukandamizaji wa mutadha, alama ilipanda hadi 38.3%—huku ikitumia takribani tokeni za matokeo pungufu mara 6. Hakuna mabadiliko kwenye muundo, lakini utendaji ulikaribia kuongezeka mara tatu. Unaweza kusoma zaidi kuhusu uchunguzi wetu wa mazingira ya uendeshaji ya ARC-AGI-3 hapa.
Mitiririko ya kazi ya mawakala mara nyingi huhusisha aina mbili za kazi:
- Kazi zinazohitaji kufanya maamuzi
- Kazi ambazo hasa huhitaji kuhamisha, kuchuja na kuunganisha data
Wakala anapopata nyaraka 100 zilizowasilishwa, akazichuja kwa tarehe na kubainisha miamala husika, muundo haupaswi kulazimika kufanya uwazaji kuhusu kila tokeo la kati ndani ya dirisha lake la muktadha. Uitaji wa Zana kwa Programu huwezesha GPT‑5.6 kuandika JavaScript ili kuratibu zana, kutekeleza miito huru kwa wakati mmoja na kuchakata matokeo yake nje ya dirisha la muktadha. Hivyo muundo unaweza kuzingatia kinachohitaji uwezo wa AI: kufanya maamuzi.
Katika kazi tata zinazoweza kufanywa sambamba, kugawa vitendo na uwazaji katika mikondo mingi ya kazi ya mawakala huwezesha kazi kukamilika haraka na kwa uwezo mkubwa zaidi wa AI. Katika mipangilio hii, wakala mkuu ana jukumu la kuratibu mawakala wasaidizi na kuwakabidhi kazi. Mawakala wasaidizi hufuatilia malengo yao sambamba, kisha hurejesha matokeo yao kwa wakala mkuu ili ayaunganishe na kutoa jibu la mwisho. Timu zinaweza kuanza kutumia mawakala wengi kwa njia asilia kwa kuwasha kipengele cha mawakala wengi(fungua katika dirisha jipya) katika Responses API. Hivi pia ndivyo mpangilio wa uwezo wa Ultra katika ChatGPT unavyofanya kazi.
“Qualia huendesha timu za mawakala kushughulikia matatizo ya utafiti yasiyo na mipaka maalumu, na GPT‑5.6 Sol ilifanya kazi kikamilifu. Ilionyesha uboreshaji mkubwa ikilinganishwa na GPT‑5.5, ikamaliza haraka kuliko karibu miundo mingine yote tuliyojaribu, na upesi ikawa muundo wetu chaguo-msingi wa OpenAI.”
“GPT‑5.6 ndiyo muundo bora zaidi wa kuratibu kazi ambao tumeona kutoka OpenAI. Tuliipa vipimo sita kwa wakati mmoja—ikiandika, ikiunda na kufafanua vyote—na ilifuatilia kila kitu bila ubora kushuka.”
Ingawa GPT‑5.6 inaweza kubaini vizuri idadi inayofaa ya mawakala wasaidizi na wakati wa kuwaanzisha, tabia ya mfumo wa mawakala wengi inaweza kuelekezwa kwa urahisi. Kuuelekeza muundo kuhusu wakati wa kuwaita mawakala wasaidizi kunaweza kuongeza uwezekano wa kuwaanzisha tu pale ambapo matumizi ya tokeni za ziada yatazalisha utendaji bora.
Katika familia nzima ya miundo, muda wa kudumu wa hifadhi muda ya maelekezo tangulizi umeongezwa hadi angalau dakika 30, na sasa sehemu za kuvunja akiba zinaweza kuwekwa kwa uthabiti ndani ya dirisha la muktadha la muundo. Hii imewezesha kampuni changa kuongeza kwa kiasi kikubwa kiwango cha kupata data kwenye akiba.
Mbali na kuweka sehemu za kuvunja akiba, kuendelea kutumia prompt_cache_key(fungua katika dirisha jipya) inayofaa huongeza uwezekano wa maombi kufikia injini ileile ya uinferensi iliyowahi kushughulikia kiambishi awali sawa, hivyo kupunguza muda wa kusubiri.
Kinachodhihirika katika mifano hii ni jinsi uchumi wa kuunda mawakala ulivyobadilika sana.
Matumizi ambayo awali yalihitaji muundo wa kiwango cha juu zaidi katika kila hatua sasa yanaweza kupata matokeo yanayolingana au bora zaidi kwa sehemu ndogo ya gharama kwa kutumia miundo midogo, kurekebisha kiwango cha uwazaji na kufanya maamuzi bora ya usanifu.
Tunafurahia kuona mtakachounda nyote!
- 2026
- Jukwaa la API
Kuhusu waandishi
Mwongozo huu uliandaliwa na Samarth Madduru(fungua katika dirisha jipya), Prashant Mital(fungua katika dirisha jipya), Dave Leo(fungua katika dirisha jipya) na Julien Reiman(fungua katika dirisha jipya), kwa kutegemea uzoefu wao wa kushirikiana kwa karibu na kampuni changa zinazounda bidhaa kwa GPT‑5.6, kuanzia majaribio ya awali hadi uzalishaji.


