Անցնել հիմնական բովանդակությանը
OpenAI

13 օգոստոսի, 2026 թ.

Կիրառական ԱԲ

GPT‑5.6-ի ուղեցույց՝ մշակողների համար

Տեխնիկական դասեր արտադրական միջավայրում աշխատող ստարտափներից

Բեռնվում է…

GPT‑5.6‑ը գին–արդյունավետության նոր չափանիշ է սահմանում

GPT‑5.6 մոդելների ընտանիքն առաջադեմ մակարդակի ագենտների արդյունավետությունը դարձնում է անհամեմատ ավելի մատչելի՝ միաժամանակ ընդլայնելով հնարավորի սահմանները։

Այս ուղեցույցում ներկայացնում ենք, թե ինչպես են ստարտափներն ավելի խելացի մոդելի ընտրությամբ և API-ի նոր կառավարիչներով ապահովում դատողության շարունակականությունը, բազմաագենտ համակարգումը և ծրագրային գործիքների կանչը՝ շատ ավելի ցածր գնով ստեղծելով ավելի արագ ու ունակ ագենտներ։

Ավելի լավ փորձառություն՝ առանց լրացուցիչ կարգաբերման

GPT‑5‑ից ի վեր մոդելների յուրաքանչյուր սերունդ նպատակ է ունեցել ավելի քիչ թոքեններով լուծել ավելի երկարատև խնդիրներ։ GPT‑5.6‑ը շարունակում է այդ ընթացքը՝ առաջարկելով ագենտների ավելի բարձր արդյունավետություն և ցածր ծախսեր՝ հիմքում ընկած հարնեսում նվազագույն փոփոխություններով։

Ընդհանուր ծախսարդյունավետության բարելավմանը գումարվում է ավելի բարձր ճշգրտությունը՝ դատողության ավելի ցածր ջանքերի դեպքում։ Օրինակ՝ Agents’ Last Exam-ում GPT‑5.6 Sol-ը «ցածր» դատողությամբ գերազանցեց «բարձր» դատողությամբ GPT‑5.5‑ին, երբ հարնեսը մնաց անփոփոխ։ Նման հաջողություններ ենք տեսել նաև արտադրական փորձարկումներում․ ստարտափները հաղորդում են տարբեր աշխատանքային հոսքերում ծախսերի զգալի նվազման մասին՝ դատողության ջանքերը նախկին լռելյայն մակարդակից իջեցնելու շնորհիվ։

GPT‑5.6-ը տեղադրեցինք մեր հարնեսում, և դատողության ցածր ջանքը տվեց մեր լավագույն արդյունքները։ Այն հասկանում էր, երբ տվյալներ պարզապես չկային, չէր հետևում սխալ հետքերին և ճիշտ պատասխանին հասնում էր ավելի քիչ թոքեններով։
— Իզի Միլեր, AI հետազոտությունների ղեկավար, Hex(բացվում է նոր պատուհանում)

Մոդելի ընտրություն

Պատմականորեն երկարատև կիրառությունների համար լավագույն տարբերակը եղել է առավելագույն հասանելի դատողությամբ ֆլագմանային մոդելին անցնելը։ Դա հիմնականում պայմանավորված էր նրանով, որ երկար համատեքստերի և գործիքների կանչերի դեպքում այս մոդելները զգալիորեն ավելի ունակ էին, քան ծախսերի համար օպտիմալացված մոդելները։ 5.6 ընտանիքը փոխել է իրավիճակը․ փորձարկման պահին ավելի շատ հաշվարկային ռեսուրս կիրառելիս Luna-ն և Terra-ն հաճախ GPT‑5.4‑ին ու 5.5-ին համադրելի արդյունք են տալիս՝ զգալիորեն ավելի ցածր գնով։

1 -ը 3-ից
Luna-ն պահպանում է GPT‑5.5‑ի արդյունահանման ճշգրտության 98%-ը՝ 18 անգամ ցածր գնով։ Դրա շնորհիվ մեր ագենտները փաստաթղթերը բարձր որակով են հասկանում այնպիսի գնով, որը կիրառելի է դարձնում լուծումը շատ ավելի մեծ թվով աշխատանքային հոսքերում։
— Սերհիյ Շչոհոլիև, ագենտների ինժեներական թիմի ղեկավար, Hypha(բացվում է նոր պատուհանում)

Դիտարկենք BrowseComp-ի առաջադրանքները՝ որոնման վրա հիմնված չափորոշիչ, որը ստուգում է քիչ հայտնի փաստեր գտնելու մոդելի կարողությունը։ Երեք ամիս առաջ GPT‑5.5‑ը (Գերհզոր) այս չափորոշիչում հավաքեց 84,36%՝ ընդհանուր $33,27 ծախսով։ Թողարկման պահին GPT‑5.6 Luna-ն (Գերհզոր) գրեթե նույն արդյունքն է տալիս՝ հավաքելով 84,04% ընդամենը $1,33 ծախսով։ Այդ ժամանակից ի վեր գներն էլ ավելի ենք նվազեցրել։ Գների մեր վերջին կրճատումների մասին կարդացեք ավելին։

5.6 ընտանիքի փոքր մոդելները հիանալի են մեծածավալ ծանրաբեռնվածությունների, հապաղման նկատմամբ զգայուն փոխազդեցությունների և ագենտային աշխատանքային հոսքերի կրկնվող քայլերի համար։ Օրինակ՝ եթե ղեկավարում եք իրավական տեխնոլոգիաների ստարտափ, որը նախքան ագենտային վերլուծությունը մշակում է ձեռագիր հուշագրեր, այլևս պետք չէ ամբողջ գործընթացում առաջադեմ մոդել օգտագործել․ արդյունահանման համար կարող եք ընտրել Terra-ն կամ Luna-ն և զգալիորեն խնայել։

Responses API-ի զարգացում՝ ավելի արդյունավետ ագենտներ նախագծելու համար

GPT‑5.6‑ի սկզբնական արդյունավետությունը բարձրացնելուց բացի՝ Responses API-ում ավելացրել ենք նոր հիմնատարրեր՝ լրացուցիչ առավելություններ ապահովելու համար։ GPT‑5.6‑ը սկզբից մինչև վերջ վարժեցրել ենք միմյանց լրացնող երեք ճարտարապետական մոտեցմամբ, որոնք ագենտներին օգնում են ավելի արդյունավետ աշխատել․

  1. Կրկին օգտագործել արդեն կատարված աշխատանքը․ մոդելի քայլերի միջև պահպանելով դատողությունը(բացվում է նոր պատուհանում) և երկարատև զրույցները սեղմելու համար կիրառելով ներկառուցված խտացում(բացվում է նոր պատուհանում)՝ մոդելը կարող է երկարատև առաջադրանքներում պահպանել աշխատանքի հետևողականությունը՝ առանց շփոթվելու կամ նախկին համատեքստը վերականգնելու։
  2. Անհրաժեշտության դեպքում զուգահեռ տարրալուծել․ ներկառուցված բազմաագենտ համակարգումը(բացվում է նոր պատուհանում) թույլ է տալիս զուգահեռ աշխատանքային հոսքերում համակարգել մի քանի ագենտի՝ բարդ առաջադրանքներն ավելի արագ ավարտելու համար։
  3. Կանխորոշված աշխատանքը տեղափոխել կոդ․ ծրագրային գործիքների կանչի(բացվում է նոր պատուհանում) միջոցով մոդելի Համատեքստային պատուհանից դուրս զտել, միավորել և համակարգել գործիքների ելքերը՝ մոդելի թոքենները պահելով գնահատողական աշխատանքի համար և նվազեցնելով ծախսը, հապաղումն ու համատեքստի վատթարացումը։

Համատեղ կիրառելիս տարբերությունը կարող է հսկայական լինել։ Օրինակ՝ ARC-AGI-3-ում GPT‑5.6 Sol-ը ստանդարտ հարնեսով հավաքեց 13,3%։ Սակայն պահպանվող դատողությունն ու խտացումը միացնելուց հետո ցուցանիշը հասավ 38,3%-ի՝ մոտ վեց անգամ պակաս ելքային թոքեն օգտագործելով։ Մոդելն անփոփոխ է, իսկ արդյունավետությունը՝ գրեթե եռապատկված։ Մանրամասներին կարող եք ծանոթանալ ARC-AGI-3-ի հարնեսի մեր ուսումնասիրությունում։

Ծրագրային գործիքների կանչ

Ագենտային աշխատանքային հոսքերը հաճախ երկու տեսակի աշխատանք են ներառում․

  1. Գնահատողական մոտեցում պահանջող առաջադրանքներ
  2. Աշխատանք, որը հիմնականում պահանջում է տվյալներ տեղափոխել, զտել և միավորել

Երբ ագենտը ստանում է 100 հաշվետվություն, զտում դրանք ըստ ամսաթվի և գտնում համապատասխան գործարքները, մոդելը չպետք է ստիպված լինի իր Համատեքստային պատուհանում վերլուծել յուրաքանչյուր միջանկյալ արդյունք։ Ծրագրային գործիքների կանչը GPT‑5.6‑ին թույլ է տալիս JavaScript գրել՝ գործիքները համակարգելու, անկախ կանչերը զուգահեռ գործարկելու և դրանց ելքերը Համատեքստային պատուհանից դուրս մշակելու համար։ Մոդելը կարող է կենտրոնանալ բանականություն պահանջող աշխատանքի՝ գնահատողական մոտեցման վրա։

Ֆինանսական հետազոտության բարդ մասը հաշվետվությունները հուսալիորեն ստանալը, գործիքները համակարգելն ու թվերը մանրամասն վերլուծելն է։ Մեր գնահատումներում GPT‑5.6‑ը ծրագրային գործիքների կանչի միջոցով համապատասխանեց մեր չափանիշների որակին՝ օգտագործելով 21%-ով պակաս մուտքային թոքեն։ Հենց դրանով է ֆինանսական հետազոտությունը քննարկող ագենտը տարբերվում այն իրականում իրականացնող ագենտից։
— Ալեքս Վան, կիրառական AI, Rogo(բացվում է նոր պատուհանում)

Բազմաագենտ համակարգ

Բարդ և զուգահեռ կատարման ենթակա առաջադրանքներում գործողություններն ու դատողությունը ագենտների մի քանի աշխատանքային հոսքերի միջև բաշխելը թույլ է տալիս ավելի արագ ավարտել աշխատանքն ու հասնել ավելի բարձր բանականության։ Այս կարգավորումներում հիմնական ագենտը համակարգում է ենթաագենտներին և առաջադրանքներ պատվիրակում նրանց։ Ենթաագենտները զուգահեռ հետապնդում են իրենց նպատակները, ապա արդյունքները փոխանցում հիմնական ագենտին՝ վերջնական ամփոփման համար։ Թիմերը կարող են անմիջապես օգտվել բազմաագենտ համակարգից՝ Responses API-ում միացնելով բազմաագենտ ռեժիմը(բացվում է նոր պատուհանում)։ ChatGPT‑ի Ultra հնարավորությունների կարգավորումը նույնպես այսպես է աշխատում։

1 -ը 2-ից
Qualia-ն անորոշ ավարտով հետազոտական խնդիրների վրա աշխատեցնում է ագենտների թիմեր, և GPT‑5.6 Sol-ը պարզապես լիովին արդարացրեց իրեն։ Այն ակնհայտորեն գերազանցեց GPT‑5.5‑ին, աշխատանքն ավարտեց մեր փորձարկած գրեթե բոլոր մյուս մոդելներից արագ և շուտով դարձավ OpenAI-ի մեր նախընտրելի մոդելը։
— Ի Չի, Quadrillion(բացվում է նոր պատուհանում)-ի հիմնադիր

Թեև GPT‑5.6‑ը լավ է որոշում ենթաագենտների համապատասխան քանակն ու դրանց գործարկման պահը, բազմաագենտ վարքագիծը հեշտ է ուղղորդել։ Մոդելին հուշելով՝ երբ կանչել ենթաագենտներին, կարելի է մեծացնել հավանականությունը, որ ագենտները կգործարկվեն միայն այն դեպքերում, երբ թոքենների լրացուցիչ ծախսը կապահովի ավելի լավ արդյունք։

Հարցումների քեշավորում

Մոդելների ամբողջ ընտանիքում հարցումների քեշի TTL-ը երկարացվել է մինչև առնվազն 30 րոպե, իսկ քեշի բաժանարար կետերն այժմ կարելի է կանխորոշված կերպով սահմանել մոդելի Համատեքստային պատուհանում։ Դրա շնորհիվ ստարտափները կարողացել են զգալիորեն բարձրացնել քեշից հաջող ընթերցումների գործակիցը։

29 000 թոքենանոց ընդհանուր հարցմանը ավելացրինք քեշի բաժանարար կետեր ու աշխատատարածքին հատուկ բանալիներ և չքեշավորված մուտքը կրճատեցինք 28%-ով։ Քեշի 30-րոպեանոց պատուհանը նույնպես մեծ հնարավորություններ բացեց․ մեր ագենտները կարող էին գործարկումների միջև կրկին օգտագործել նույն համատեքստը՝ ամեն անգամ զրոյից սկսելու փոխարեն։
— Լորենցո Ջենտիլե, AI ինժեներ, Ploy(բացվում է նոր պատուհանում)

Քեշի բաժանարար կետեր սահմանելու հետ մեկտեղ համապատասխան prompt_cache_key(բացվում է նոր պատուհանում)-ի շարունակական օգտագործումը մեծացնում է հավանականությունը, որ հարցումը կհասնի նույն եզրակացության շարժիչին, որը նախկինում մշակել է նույն նախածանցը՝ այդպիսով նվազեցնելով հապաղումը։

Եզրակացություն

Այս օրինակներում հատկապես աչքի է ընկնում, թե որքան է փոխվել ագենտներ ստեղծելու տնտեսագիտությունը։

Այն կիրառությունները, որոնց յուրաքանչյուր քայլի համար նախկինում առաջադեմ մոդել էր պահանջվում, այժմ կարող են համադրելի կամ ավելի լավ արդյունքներ ապահովել շատ ավելի ցածր գնով՝ օգտագործելով փոքր մոդելներ, կարգավորելով դատողության ջանքը և կատարելով արդյունավետ ճարտարապետական ընտրություններ։

Անհամբեր սպասում ենք՝ տեսնելու, թե ինչ կստեղծեք։

  • 2026
  • API Platform-ը

Հեղինակների մասին

Այս ուղեցույցը մշակել են Սամարթ Մադուրուն(բացվում է նոր պատուհանում), Պրաշանտ Միտալը(բացվում է նոր պատուհանում), Դեյվ Լեոն(բացվում է նոր պատուհանում) և Ժյուլիեն Ռեյմանը(բացվում է նոր պատուհանում)՝ հիմնվելով վաղ փորձարկումներից մինչև արտադրական փուլ GPT‑5.6-ով լուծումներ ստեղծող ստարտափների հետ սերտ աշխատանքի իրենց փորձի վրա։