Pāriet uz galveno saturu
OpenAI

2026. gada 22. septembris

Produkts

Labāka uzvedņu kešošana modelim GPT‑6

Augstāks kešatmiņas trāpījumu īpatsvars un jauni rīki, kas palīdz pastāvīgiem aģentiem strādāt ātrāk un lētāk.

Notiek ielāde…

GPT‑6 ļauj pastāvīgiem aģentiem stundām ilgi veikt sarežģītus uzdevumus — no kodu bāzu pārstrukturēšanas līdz rūpīgi izpētītu dokumentu un prezentāciju sagatavošanai. Šo aģentu pamatā esošās lietotnes veic virkni savstarpēji saistītu API pieprasījumu, bieži pārnesot no iepriekšējām sarunas kārtām tās pašas instrukcijas, rīku definīcijas un kontekstu. OpenAI kešo šo kopīgo kontekstu, lai aprēķinus varētu atkārtoti izmantot vairākos pieprasījumos. Tas saīsina atbildes laiku un nodrošina izstrādātājiem līdz pat 90% atlaidi kešotajām ievades tekstvienībām.

Līdz ar GPT‑6 saimi ieviesām uzlabotu uzvedņu kešošanas sistēmu, kas pēc noklusējuma nodrošina augstāku kešatmiņas trāpījumu īpatsvaru. Tagad kešatmiņas atlaides piešķiram piemērotiem kopīgajiem prefiksiem, kas atkārtoti izmantoti 30 minūšu periodā. Ieviešam arī jaunus rīkus, kas izstrādātājiem palīdz pārraudzīt kešatmiņas veiktspēju, diagnosticēt netrāpījumus un izvēlēties, cik lielu uzvednes daļu kešot.

OpenAI uzvedņu kešošanai ir būtiska nozīme, lai GitHub Copilot plašā mērogā nodrošinātu ātru un efektīvu lietošanu. Pēdējo mēnešu laikā miljardiem OpenAI modeļiem nosūtītu pieprasījumu esam par vairāk nekā 50% samazinājuši to uzvedņu tekstvienību daļu, kuras jāapstrādā no jauna, salīdzinot ar iepriekšējo atskaites līmeni. Rezultātā izsecināšanas tehnoloģiju kopums ir efektīvāks un izstrādātāji pirmo atbildi saņem ātrāk.
—Mario Rodriguez, produktu direktors

Kešošanas pārraudzība un netrāpījumu diagnostika

Jaunajā uzvedņu kešošanas informācijas panelī(atveras jaunā logā) var redzēt, cik liela lietotnes ievades daļa tiek iegūta no kešatmiņas. Sekojiet trāpījumu īpatsvara izmaiņām laika gaitā un ievades sastāva diagrammā salīdziniet kešotās un nekešotās tekstvienības. Šie skati palīdz pamanīt kešatmiņas trāpījumu kritumu un novērtēt, kā lietotnes izmaiņas ietekmē kešošanas veiktspēju.

Uzvedņu kešošanas informācijas panelis ar kešatmiņas trāpījumu īpatsvaru, veiktspējas izmaiņām laika gaitā un ievades tekstvienību sastāvu.

Ja noticis negaidīts kešatmiņas netrāpījums, izmantojiet uzvedņu kešošanas diagnostikas rīku(atveras jaunā logā), lai noskaidrotu cēloni. Salīdziniet pieprasījumu ar nesenu atbildi, lai noteiktu modeļa, rīku, iestatījumu vai ievades izmaiņas, kuru dēļ atkārtota izmantošana nebija iespējama. Aptuvenais ietekmēto tekstvienību skaits palīdz novērtēt ietekmes apmēru un izlemt, kā optimizēt integrāciju, lai maksimāli palielinātu kešatmiņas trāpījumu īpatsvaru.

{
  "prompt_cache_diagnostics": {
    "type": "cache_miss",
    "reason": "tools_changed",
    "comparison_reusable_tokens": 5629,
    "cache_missed_tokens": 5629
  }
}

Kešošanas optimizēšana lietotnei

Izvēlieties, ko kešot. Skaidri norādīti kešatmiņas robežpunkti ļauj izvēlēties, kurus uzvednes prefiksus izmantot atkārtoti. Atjauninātajā uzvedņu kešošanas rokasgrāmatā(atveras jaunā logā) paskaidrots, kā tos izmantot, cik ilgi kešotie prefiksi ir piemēroti atkārtotai izmantošanai un kā to ietekmē rīku un ievades izmaiņas.

Mainiet spriestspējas līmeni, nezaudējot kešatmiņu. GPT‑6 modeļos tagad varat mainīt spriestspējas līmeni(atveras jaunā logā) starp atbildēm, nezaudējot kešatmiņu. Sarežģītākam uzdevumam paaugstiniet līmeni, bet vienkāršam papildjautājumam to pazeminiet, pievienojot configuration_update un nemainot pieprasījuma līmeņa spriestspējas iestatījumu. Tādējādi varat pielāgot uzdevumam vajadzīgo spriestspējas apjomu, vienlaikus saglabājot atkārtoti izmantojamo kontekstu.

Saglabājiet kešatmiņu, mainoties rīkiem un instrukcijām. Mainoties aģenta vajadzībām izmantot rīkus, saglabājiet nemainīgas rīku definīcijas, shēmas un secību, lai iepriekšējo kontekstu joprojām varētu izmantot atkārtoti. Izmantojiet allowed_tools, lai varētu izsaukt tikai atbilstošos rīkus, vai, ja rīki nav vajadzīgi, iestatiet tool_choice vērtību none, nevis noņemiet definīcijas. Ar jauniem izstrādātāja ziņojumiem konteksta beigās pievienojiet jaunas instrukcijas, kas aizstāj iepriekšējās. Skatiet mūsu ieteikumus par rīku izmaiņu pārvaldību(atveras jaunā logā).

Iepriekš iesildiet kešatmiņu, lai samazinātu aizkavi. Iepriekšēja iesildīšana(atveras jaunā logā) laikus sagatavo zināmo kontekstu, lai pēc pieprasījuma saņemšanas modelis varētu ātrāk sākt atbildēt. Piemēram, lietotne palaišanas laikā var iepriekš iesildīt kopīgās instrukcijas, rīku definīcijas vai uzziņu materiālus, pirms lietotājs uzdod pirmo jautājumu. Tādējādi apstrāde nenotiek laikā, kad lietotājs gaida.

Šīs izvēles vadīklas papildina programmas pamatdarbību un palīdz pielāgot kešošanu konkrētajai darba slodzei.

1 no 3
OpenAI uzvedņu kešošanas diagnostika un informācijas panelis palīdzēja mums par dažiem procentpunktiem palielināt kešatmiņas trāpījumu īpatsvaru un samazināt izmaksas par 20%. Tagad saņemam brīdinājumus, ja kešošana negaidīti pārstāj darboties, un pamatcēloņa noteikšanai izmantojam Codex aģentus. Skaidri norādīti robežpunkti ļauj arī kešot nemainīgo kontekstu, bet bieži mainīgo saturu atstāt uzvednes beigās. Tādējādi sarunu sazarošana fona uzdevumiem ir kļuvusi ekonomiski izdevīga, vienlaikus atkārtoti izmantojot gandrīz visu kopīgo kontekstu.
—Arian Hanifi, tehnoloģiju direktors

Darba sākšana

Autors

OpenAI