Водич за моделите од семејството GPT‑6
Практични совети за најдобри резултати од моделите GPT‑6 со контрола врз времето и трошоците
GPT‑6 е нашиот најнапреден пакет модели досега и ви нуди избор на модели за различни видови работа.
Без разлика дали претворате идеја во функционален прототип, развивате и тестирате функција или координирате повеќечекорни работни текови низ репозиториуми за код, бази на податоци и надворешни API, овој водич објаснува како да изберете модел GPT‑6, да му дадете ефективни инструкции, да управувате со долготрајна работа и да се подготвите за продукција.

Работете ефикасно во продукција. Користете кеширање(се отвора во нов прозорец) и компакција(се отвора во нов прозорец) за управување со контекстот и трошоците. Мерете ги успехот на задачите и доцнењето и планирајте следење и контроли за податоците.
Изберете модел соодветен за работата. Урамнотежете ги способностите, трошоците и доцнењето со избор на модел, напор за расудување(се отвора во нов прозорец) и брзина соодветни за задачата.
Приспособете ги промптовите и вештините. Усогласете ги промптовите, вештините и инструкциите во репозиториумот за тоа што треба да испорача моделот, што може да направи самостојно и кога работата се смета за завршена.
Насочувајте ја долготрајната работа. Користете насочување(се отвора во нов прозорец), асинхрони алатки(се отвора во нов прозорец) и делегирање(се отвора во нов прозорец) за управување со измените и независната работа. Поставете јасни граници за тоа кога моделот треба да побара насоки.
Пред пуштањето во употреба, воведете неколку проверки и добри практики.
Имајте ја предвид ефикасноста. (се отвора во нов прозорец)Отстранете го контекстот што не ѝ е потребен на задачата(се отвора во нов прозорец), но зачувајте ги потребните докази. Ако апликацијата го поддржува тоа, извршувајте независни задачи истовремено(се отвора во нов прозорец) за еден бавен чекор да не ја задржува неповрзаната работа.
За повторливи задачи, користете го заедничкиот контекст повторно преку кеширање промпт(се отвора во нов прозорец). Кешираните влезни токени чинат до 95% помалку(се отвора во нов прозорец) од некешираните, зависно од моделот. Ставете ги постојаните инструкции и референтните материјали пред променливите детали за задачата и одржувајте ги дефинициите на алатките доследни. Контролната табла за кеширање(се отвора во нов прозорец) и водичот за дијагностика(се отвора во нов прозорец) ви помагаат да видите каде повторното користење престанува да функционира. При процена на трошокот за цел работен тек, вклучете ги запишувањата во кешот и сите тарифи за долг контекст.
Кај подолги разговори, компакцијата(се отвора во нов прозорец) го намалува контекстот, зачувувајќи ја состојбата потребна за продолжување.
Одлучете како ќе го следите однесувањето(се отвора во нов прозорец) и прегледајте ги контролите за податоци(се отвора во нов прозорец) за вашата апликација.
Тестирајте пред пуштањето во употреба: извршете репрезентативни задачи и измерете ги успехот, доцнењето и трошокот по успешна задача. Погледнете ја нашата листа за проверка пред пуштање во употреба со API(се отвора во нов прозорец).
Разгледувајте го изборот на модел и ниво на расудување како компромис меѓу интелигенцијата и цената.
Модел:
GPT‑6 Astra(се отвора во нов прозорец) за најтешките задачи со расудување, каде што е потребна максимална интелигенција.
GPT‑6.1 Sol(се отвора во нов прозорец) за сложено програмирање, истражување и користење компјутер.
GPT‑6 Luna(се отвора во нов прозорец) за тесно насочени задачи во голем обем и секојдневна, повторлива работа со јасна цел, како извлекување полиња од фактури, класификација на барања или создавање структурирани резимеа.
Кога го оценувате најдобриот модел за задачата, споредете ги цените(се отвора во нов прозорец) за секој модел.
Ниво на расудување: Во API, изберете колку напор моделот ќе вложи во задачата.
Ниска: рутински задачи, како извлекување факти или мали измени.
Средна: работа што бара проценка, како планирање функција или споредба на опции.
Висока: отстранување сложени грешки, подлабока анализа или внимателна проверка.
Многу висока / Max: тестирајте ги каде што се поддржани ако „Висока“ не е доволна и задржете ги само ако подобрувањето ги оправдува дополнителното време и трошок.
Во API, можете да го смените напорот за расудување среде разговор(се отвора во нов прозорец) без да го нарушите кеширањето.
Во Codex, почнете со стандардното ниво на расудување за моделот, па намалете го за поедноставни задачи или зголемете го за подлабока анализа.
Брзина:
Во API, користете Брз режим(се отвора во нов прозорец) кога времето на одговор е важно, на пример во апликации за разговор или алатки за програмирање. Тој нуди побрзо и постабилно време на одговор, со повисок трошок по токен од стандардната обработка.
Во Codex и API, користете Ultrafast(се отвора во нов прозорец) кога побрзите одговори ја оправдуваат доплатата, на пример при брзи итерации во програмирањето. Тој го забрзува генерирањето токени независно од напорот за расудување. Достапно за GPT‑6 Astra(се отвора во нов прозорец).

— Ерик Провенчер, тим за искуство на програмерите во OpenAI
Почнете со јасна задача: посакуваниот резултат, за кого е наменет, релевантниот контекст и ограничувањата, како и условите за завршување. Потоа разгледајте ги овие четири области, сумирани од Преосмислување на вештините и промптовите за GPT‑6 Astra(се отвора во нов прозорец), за подетален увид во ажурирањето на инструкциите:
Создавајте подобри вештини: Кратко и јасно опишете кога треба да се изврши секоја вештина, вчитувајте дополнителни детали само по потреба и заменете ги крутите постапки со насоки соодветни за моделите што ги користи тимот.
Ажурирајте го AGENTS.md: Објаснете кога се релевантни одредени документи и тестови и изречно дозволете безбедни рутински работни текови, како локални тестови со привремени податоци и без пристап до продукција.
Поставете граници за одлучување: Наведете кои дејства може да се извршат самостојно, а кои бараат одобрение, заменувајќи ги општите правила „секогаш прашувај“ со јасни граници.
Дајте јасни насоки за истрајност: Дефинирајте што опфаќа „завршено“ — спроведување на измената, извршување, проверка на резултатот и поправање грешки — и наведете кои одлуки бараат ваша проверка.
За дополнителни насоки, видете ги добрите практики за расудување(се отвора во нов прозорец).
Без разлика дали работите во Codex или развивате со API, наведете кои одлуки може да ги носи моделот, кога треба да побара насоки и како изгледа корисен одговор.
Дајте му доволно насоки на моделот за работата да напредува без да нагаѓа при важните одлуки. (се отвора во нов прозорец)Кажете му кои избори може да ги направи и кога да побара ваши насоки(се отвора во нов прозорец). На пример, може да избере како да организира резиме, но треба да се консултира со вас пред да го промени опсегот на проектот. (се отвора во нов прозорец)Опишете како изгледа корисен одговор(се отвора во нов прозорец): на пример, едноставен јазик, технички детали соодветни за публиката и краток завршен преглед на измените, проверките и она што сѐ уште бара внимание.
Со семејството модели GPT‑6, сега можете да преземете задачи што траат со часови или денови. Користете ги следниве функции за подобро управување со агентите при долготрајни задачи.
Во API, користете насочување, асинхрони алатки и паралелна работа за долготрајните задачи да напредуваат.
Ажурирајте ги инструкциите во текот на извршувањето: Насочувањето во текот на одговорот(се отвора во нов прозорец) ви овозможува да испратите корекција преку Responses WebSocket API(се отвора во нов прозорец) додека моделот работи. Ажурирањата се додаваат во редица; не ги откажуваат активните алатки и не ги поништуваат завршените дејства.
Продолжете со работа додека се извршува алатка: Асинхроното повикување алатки(се отвора во нов прозорец) му овозможува на моделот да продолжи со независна работа додека апликацијата извршува побавна задача, како тестови. Апликацијата го враќа резултатот кога ќе биде подготвен. Почекајте го тој резултат пред да почнете работа што зависи од него.
Делегирајте независни подзадачи: GPT‑6.1 Sol поддржува работни текови со повеќе агенти во Responses API(се отвора во нов прозорец). Може да им додели независна работа на подагенти (како истражување различни делови од базата на код) и да ги обедини нивните наоди во конечен одговор. Работата со повеќе агенти моментално е во бета-фаза.
При долготрајни задачи може да се појави потреба од одлуки што не сте ги предвиделе во почетниот промпт. Користете појаснување и насочување за работата да остане на вистинскиот пат.
Одговарајте на прашања во текот на работата: Со GPT‑6 Astra, Codex може да побара појаснување додека работи(се отвора во нов прозорец). Разрешете ги прашањата што влијаат врз следниот чекор и наведете која независна работа може да продолжи додека одлучувате. Ако ќе бидете отсутни, кажете му на Codex кои задачи може да продолжат и кога треба да запре и да го почека вашиот одговор.
Пренасочете ја работата кога ќе се променат барањата: Насочете ја активната задача(се отвора во нов прозорец) со нови информации, објаснувајќи што треба да се промени, а што да остане исто. Така избегнувате да трошите дополнително време на пристап што повеќе не одговара на вашите потреби.

Користењето компјутер(се отвора во нов прозорец) им овозможува на GPT‑6 Astra, GPT‑6.1 Sol и GPT‑6 Luna директно да работат со веб-страници и десктоп-апликации, дури и со апликации без API. На пример, можете да побарате од моделот да истражи грешка, да го поправи кодот и да го отвори производот во прелистувач за да провери дали поправката функционира.
Изберете го наједноставниот сигурен начин за секој чекор:
Користете API или поврзана алатка кога може директно да ја заврши работата.
Користете ја функцијата за користење компјутер кога моделот треба да прочита екран, да кликне на копчиња или да пополни формулар за вас.
Ако вградувате користење компјутер во сопствена апликација, дајте му на моделот алатка што може да извршува код за управување со прелистувач или работна површина. Playwright работи со прелистувачи(се отвора во нов прозорец); PyAutoGUI работи со десктоп-апликации.



