Basis: adózási munkafüzet kétszer gyorsabban a GPT‑6 Astrával
A GPT‑6 Astra 50%-kal kevesebb idő alatt végzett az összetett feladatokkal, mint a GPT‑5.6 Sol, és mélyebben megértette a felhasználó szándékát.
Munkafüzet-kitöltési teszt
50%
Ennyivel kevesebb idő kellett egy 50 munkalapos adózási munkafüzet kitöltéséhez a Solhoz képest a Basis tesztjében.
Belső értékelések
20%
Megközelítőleg ennyivel javultak a Basis belső értékelésein elért pontszámok.
A Basis(új ablakban nyílik meg) olyan MI-ügynököket fejleszt, amelyek automatizálják a könyvelők napi manuális munkájának jelentős részét, így az ismétlődő feladatok helyett stratégiai munkára fordíthatják az idejüket. A vállalat kutatásai olyan ügynökökre összpontosítanak, amelyek megbízhatóan végzik el a hosszadalmas feladatokat. A GPT‑6 Astra esetében azt tapasztalják, hogy jobban megérti, mit szeretnének elérni a könyvelők.
„A GPT-6 Astra jobban megérti a felhasználó valódi szándékát és magát a problémát.”
A Basis egy összetett, 50 munkalapos adózási munkafüzeten hasonlította össze a GPT‑6 Astra és a GPT‑5.6 Sol teljesítményét. A feladat a munkafüzet pontos és megbízható kitöltése volt, amelyet a GPT‑6 Astra lényegesen gyorsabban végzett el.
„A GPT-6 Astra feleannyi idő alatt képes kitölteni ezt a munkafüzetet, mint a GPT-5.6 Sol.”
A Basis azt is megfigyelte, hogy a GPT‑6 Astra már a feladat elején jobb döntéseket hoz. Ez segít a Basis ügynökeinek abban, hogy kevesebb kitérővel végezzék el a munkát, és kevesebb időt töltsenek a hibák javításával. Troyanovsky szerint ennek köszönhetően a modell a tokeneket is hatékonyabban használja fel.
A Basis a GPT‑6 Astrával a feladat előrehaladtával az érvelésre fordított erőforrásokat is szabályoztatja: a nehezebb lépéseknél több, a könnyebbeknél kevesebb számítási kapacitást használ. A modell úgy képes elvégezni ezeket a módosításokat, hogy közben a gyorsítótár tartalma érintetlen marad. Troyanovsky szerint ez segít csökkenteni a költségeket és a válaszidőt, így a hosszan futó feladatok gazdaságosabbá válnak a Basis és ügyfelei számára.
A Basis belső értékelésein a GPT‑6 Astra mintegy 20%-kal jobb pontszámokat ért el, mivel jobban megérti a felhasználó szándékát: azt is, hogy mikor kell kérdeznie, jeleznie a feltételezéseit vagy követnie az utasításokat.
A Basis az ügynökei munkavégzését és végső válaszait is értékeli. Vizsgálja például, hogy követik-e a sablonokat, adózási kérdésekben támaszkodnak-e elsődleges forrásokra, és ellenőrzik-e a saját munkájukat. A GPT‑6 Astra a tágabb kontextusból is képes kikövetkeztetni ezeket az elvárásokat, kevesebb kifejezett utasítás mellett.
Így a Basisnek ritkábban kell külön szabályokat írnia az egyes helyzetekre, a csapat pedig biztosabb lehet abban, hogy ügynökei a belső tesztekben nem szereplő helyzetekkel is megbirkóznak.


