Basis 使用 GPT‑6 Astra,完成稅務活頁簿的時間減半
GPT‑6 Astra 完成複雜任務所需的時間比 GPT‑5.6 Sol 少 50%,並展現出對用戶意圖更深入的理解。
活頁簿測試
50%
在 Basis 的測試中,完成含 50 個工作表的稅務活頁簿所需時間,相較 Sol 的減幅。
內部評估
20%
Basis 內部評估分數的大約提升幅度。
Basis(在新視窗中開啟) 開發 AI 智能體,將會計師日常大量手動工作自動化,協助他們將時間從重複性任務轉投策略性工作。該公司的研究重點,是能夠可靠地完成長時間任務的智能體。採用 GPT‑6 Astra 後,公司發現模型更能理解會計師想達成的目標。
「GPT-6 Astra 更能真正理解用戶的意圖與所要解決的問題。」
Basis 以一份含 50 個工作表的複雜稅務活頁簿,比較 GPT‑6 Astra 和 GPT‑5.6 Sol 的表現。任務要求準確、可靠地完成活頁簿,而 GPT‑6 Astra 的速度明顯更快。
「GPT-6 Astra 完成該活頁簿所需的時間,只有 GPT-5.6 Sol 的一半。」
Basis 亦指出,GPT‑6 Astra 在任務開始時能作出更好的決策,讓 Basis 的智能體以更直接的方式完成工作,減少糾正錯誤所花的時間。Troyanovsky 表示,這亦提升了模型使用 token 的效率。
Basis 亦讓 GPT‑6 Astra 隨任務進展調整推理投入:遇到困難步驟時增加運算量,較簡單時則減少。模型在作出這些調整時,仍能保留完整的快取。Troyanovsky 表示,這有助降低成本及縮短回應時間,讓 Basis 及其客戶更具成本效益地執行長時間任務。
採用 GPT‑6 Astra 後,Basis 的內部評估分數提升了約 20%,主要得益於模型更能理解用戶意圖,包括何時應提問、指出假設及遵循指示。
Basis 會評估智能體的工作方式及最終答案,包括是否遵循範本、就稅務問題查閱第一手資料,以及檢查自身的工作。GPT‑6 Astra 能從更廣泛的上下文推斷出這些要求,所需的明確指示更少。
這減少了 Basis 為個別情況編寫規則的需要,亦讓團隊更有信心,相信智能體能應付內部測試未涵蓋的情況。


