Водич кроз моделе породице GPT‑6
Практични савети за најбоље резултате уз GPT‑6 моделе, уз контролу времена и трошкова
GPT‑6 је наш најнапреднији скуп модела до сада и нуди вам избор модела за различите врсте посла.
Било да идеју претварате у функционалан прототип, развијате и тестирате функцију или координишете вишекорачне токове рада у депоима кода, базама података и спољним API-јима, овај водич објашњава како да изаберете GPT‑6 модел, дате му делотворне инструкције, управљате дуготрајним радом и припремите се за продукцију.

Радите ефикасно у продукцији. Користите кеширање(отвара се у новом прозору) и компакцију(отвара се у новом прозору) за управљање контекстом и трошковима. Мерите успешност задатака и кашњење и планирајте надзор и контроле података.
Изаберите модел према радном оптерећењу. Уравнотежите могућности, трошкове и кашњење избором модела, нивоа напора при резоновању(отвара се у новом прозору) и брзине који одговарају задатку.
Прилагодите инструкције и вештине. Ускладите инструкције, вештине и упутства у депоу о томе шта модел треба да испоручи, шта сме да ради самостално и када је задатак завршен.
Одржите дуготрајан рад на правом путу. Користите усмеравање(отвара се у новом прозору), асинхроне алате(отвара се у новом прозору) и делегирање(отвара се у новом прозору) за управљање изменама и независним радом. Јасно одредите када модел треба да затражи ваше мишљење.
Пре пуштања у рад треба увести неколико провера и добрих пракси.
Водите рачуна о ефикасности. (отвара се у новом прозору)Избаците контекст који задатку није потребан(отвара се у новом прозору), али задржите потребне доказе. Ако апликација то подржава, извршавајте независне задатке истовремено(отвара се у новом прозору) како један спор корак не би задржавао неповезани рад.
За послове који се понављају, поново користите заједнички контекст кроз кеширање инструкције(отвара се у новом прозору). Кеширани улазни токени коштају и до 95% мање(отвара се у новом прозору) од некешираних, у зависности од модела. Сталне инструкције и референтни материјал поставите пре променљивих детаља задатка и одржавајте дефиниције алата доследним. Контролна табла за кеширање(отвара се у новом прозору) и водич за дијагностику(отвара се у новом прозору) помажу вам да уочите где поновна употреба не успева. При процени трошкова целог тока рада укључите уписе у кеш и евентуалне тарифе за дуг контекст.
У дужим разговорима, компакција(отвара се у новом прозору) смањује величину контекста уз очување стања потребног за наставак.
Одлучите како ћете пратити понашање(отвара се у новом прозору) и прегледајте контроле података(отвара се у новом прозору) за своју апликацију.
Тестирајте пре пуштања у рад: покрените репрезентативне задатке и измерите успешност, кашњење и трошак по успешном задатку. Погледајте нашу контролну листу за пуштање у рад уз API(отвара се у новом прозору).
При избору модела и нивоа резоновања одмерите интелигенцију и цену.
Модел:
GPT‑6 Astra(отвара се у новом прозору) за најтеже задатке резоновања који захтевају максималну интелигенцију.
GPT‑6.1 Sol(отвара се у новом прозору) за сложено програмирање, истраживање и коришћење рачунара.
GPT‑6 Luna(отвара се у новом прозору) за уско дефинисане задатке великог обима и свакодневни, понављајући рад са јасним циљем, попут издвајања поља из фактура, класификације захтева или израде структурираних сажетака.
Када бирате најбољи модел за задатак, упоредите цене(отвара се у новом прозору) свих модела.
Ниво резоновања: У API-ју изаберите колико напора модел улаже у задатак.
Ниско: рутински задаци, попут издвајања чињеница или мањих измена.
Средње: рад који захтева просуђивање, попут планирања функције или поређења опција.
Високо: тешко отклањање грешака, дубља анализа или пажљив преглед.
Веома високо / Max: испробајте где је подржано ако ниво „високо“ није довољан и задржите само ако побољшање оправдава додатно време и трошкове.
У API-ју можете променити ниво напора при резоновању усред разговора(отвара се у новом прозору) без нарушавања кеша.
У Codex-у почните са подразумеваним нивоом резоновања за тај модел, па га снизите за једноставније задатке или повећајте за дубљу анализу.
Брзина:
У API-ју користите Брзи режим(отвара се у новом прозору) када је време одзива важно, на пример у апликацијама за ћаскање или алатима за програмирање. Он пружа бржи и уједначенији одзив, уз вишу цену по токену него стандардна обрада.
У Codex-у и API-ју користите Ултрабрзи режим(отвара се у новом прозору) када бржи одговори оправдавају вишу цену, рецимо при брзим итерацијама програмирања. Он убрзава генерисање токена независно од нивоа напора при резоновању. Доступно за GPT‑6 Astra(отвара се у новом прозору).

— Ерик Провенчер, тим за искуство програмера у компанији OpenAI
Почните јасним задатком: наведите жељени резултат, коме је намењен, релевантан контекст и ограничења, као и услове за завршетак. Затим размотрите ове четири области, сажете из текста Нови приступ вештинама и инструкцијама за GPT‑6 Astra(отвара се у новом прозору), да бисте детаљније сагледали како да ажурирате инструкције:
Направите боље вештине: У кратким описима јасно наведите када се која вештина покреће, учитавајте додатне детаље само по потреби и замените круте поступке смерницама прилагођеним моделима које ваш тим користи.
Ажурирајте AGENTS.md: Објасните када су поједини документи и тестови релевантни и изричито одобрите безбедне рутинске токове рада, попут локалних тестова са привременим подацима и без приступа продукцији.
Поставите границе одлучивања: Наведите које радње могу да се обављају самостално, а које захтевају одобрење, замењујући општа правила „увек питај“ јасним границама.
Јасно одредите колико треба истрајати: Дефинишите шта значи „завршено“ — спровођење измене, покретање, преглед резултата и отклањање грешака — и наведите одлуке које морате да прегледате.
За додатне смернице погледајте најбоље праксе за резоновање(отвара се у новом прозору).
Било да радите у Codex-у или развијате уз API, наведите које одлуке модел сме да доноси, када треба да затражи ваше мишљење и како изгледа користан одговор.
Дајте моделу довољно смерница да рад напредује без нагађања о важним одлукама. (отвара се у новом прозору)Реците му које изборе сме да прави и када да затражи ваше мишљење(отвара се у новом прозору). На пример, може сам да одлучи како да организује сажетак, али треба да вас пита пре него што промени обим пројекта. (отвара се у новом прозору)Опишите како изгледа користан одговор(отвара се у новом прозору): на пример, једноставан језик, технички детаљи прилагођени публици и кратак завршни извештај о томе шта је промењено, шта је проверено и шта још захтева пажњу.
Уз породицу модела GPT‑6 сада можете да се прихватите задатака који трају сатима или данима. Користите следеће функције да боље управљате агентима на дуготрајним задацима.
У API-ју користите усмеравање, асинхроне алате и паралелни рад како би дуготрајни задаци напредовали.
Ажурирајте инструкције током извршавања: Усмеравање током одговора(отвара се у новом прозору) омогућава вам да пошаљете исправку преко Responses WebSocket API-ја(отвара се у новом прозору) док модел ради. Измене се стављају у ред; не прекидају покренуте алате нити поништавају завршене радње.
Наставите рад док се алат извршава: Асинхроно позивање алата(отвара се у новом прозору) омогућава моделу да настави независан рад док апликација извршава спорији задатак, попут тестова. Апликација враћа резултат када буде спреман. Сачекајте тај резултат пре него што започнете рад који зависи од њега.
Делегирајте независне подзадатке: GPT‑6.1 Sol подржава токове рада са више агената у Responses API-ју(отвара се у новом прозору). Може да додели независне послове подагентима, попут истраживања различитих делова базе кода, и обједини њихове налазе у коначан одговор. Рад са више агената је тренутно у бета фази.
Током дуготрајних задатака може се јавити потреба за одлукама које нисте могли да предвидите у почетној инструкцији. Користите појашњења и усмеравање да рад остане на правом путу.
Одговарајте на питања током рада: Уз GPT‑6 Astra, Codex може да тражи појашњења док ради(отвара се у новом прозору). Разрешите питања која утичу на следећи корак и наведите који независни послови могу да се наставе док одлучујете. Ако ћете бити одсутни, реците Codex-у који задаци могу да се наставе и када треба да застане и сачека ваш одговор.
Преусмерите рад када се захтеви промене: Усмерите текући задатак(отвара се у новом прозору) новим информацијама, уз објашњење шта треба променити, а шта оставити исто. Тако избегавате даље трошење времена на приступ који више не одговара вашим потребама.

Коришћење рачунара(отвара се у новом прозору) омогућава моделима GPT‑6 Astra, GPT‑6.1 Sol и GPT‑6 Luna да директно раде са веб-сајтовима и десктоп апликацијама, чак и онима без API-ја. На пример, можете да затражите од модела да истражи грешку, исправи код и отвори ваш производ у прегледачу како би проверио да ли исправка функционише.
За сваки корак изаберите најједноставнији поуздан начин:
Користите API или повезани алат када може директно да обави посао.
Користите функцију коришћења рачунара када модел треба да прочита садржај екрана, кликне на дугмад или попуни образац уместо вас.
Ако у своју апликацију уграђујете коришћење рачунара, дајте моделу алат који може да извршава код за управљање прегледачем или радном површином. Playwright ради са прегледачима(отвара се у новом прозору), а PyAutoGUI са десктоп апликацијама.



