Basis: registru fiscal completat de 2x mai rapid cu GPT‑6 Astra
GPT‑6 Astra a finalizat sarcini complexe într-un timp cu 50% mai scurt decât GPT‑5.6 Sol și a demonstrat o înțelegere mai profundă a intenției utilizatorului.
Test cu registru de calcul
50%
Mai puțin timp pentru completarea unui registru de calcul fiscal cu 50 de foi față de Sol, în testul Basis.
Evaluări interne
20%
Îmbunătățire aproximativă a scorurilor obținute la evaluările interne Basis.
Basis(se deschide într-o fereastră nouă) dezvoltă agenți AI care automatizează o mare parte din munca manuală de zi cu zi a contabililor, ajutându-i să dedice mai mult timp activităților strategice în locul sarcinilor repetitive. Compania își concentrează cercetarea asupra agenților capabili să îndeplinească în mod fiabil sarcini de lungă durată, iar cu GPT‑6 Astra observă o mai bună înțelegere a obiectivelor contabililor.
„GPT-6 Astra înțelege mai bine, în profunzime, intenția utilizatorului și problema.”
Basis a comparat GPT‑6 Astra cu GPT‑5.6 Sol folosind un registru de calcul fiscal complex, cu 50 de foi. Sarcina era completarea corectă și fiabilă a registrului, iar GPT‑6 Astra a fost considerabil mai rapid.
„GPT-6 Astra poate completa acel registru de calcul în jumătate din timpul necesar pentru GPT-5.6 Sol.”
Basis a observat și că GPT‑6 Astra ia decizii mai bune la începutul unei sarcini, ajutând agenții Basis să ajungă mai direct la rezultat și să petreacă mai puțin timp corectând greșeli. Potrivit lui Troyanovsky, acest lucru face ca modelul să utilizeze tokenurile mai eficient.
Basis folosește GPT‑6 Astra și pentru a adapta efortul de raţionament pe parcursul unei sarcini, alocând mai multe resurse de calcul etapelor dificile și mai puține celor ușoare. Modelul poate face aceste ajustări păstrându-și memoria cache intactă. Troyanovsky spune că acest lucru contribuie la reducerea costurilor și a timpului de răspuns, făcând sarcinile de lungă durată mai economice pentru Basis și clienții săi.
Cu GPT‑6 Astra, Basis a înregistrat o îmbunătățire de aproximativ 20% a scorurilor la evaluările interne, datorită unei mai bune înțelegeri a intenției utilizatorului, inclusiv când să pună întrebări, să semnaleze presupunerile și să urmeze instrucțiunile.
Basis evaluează modul în care lucrează agenții săi și răspunsurile lor finale, verificând inclusiv dacă respectă șabloanele, consultă surse primare pentru întrebările fiscale și își verifică propria muncă. GPT‑6 Astra poate deduce aceste așteptări dintr-un context mai larg, cu mai puține instrucțiuni explicite.
Astfel, Basis are mai puțină nevoie să scrie reguli pentru fiecare situație în parte, iar echipa are mai multă încredere că agenții săi pot gestiona și situații care nu sunt acoperite de testele interne.


