跳至主要内容
OpenAI

2026年9月28日

Basis 借助 GPT‑6 Astra,将税务工作簿完成时间缩短一半

GPT‑6 Astra 完成复杂任务的用时比 GPT‑5.6 Sol 缩短了 50%,对用户意图的理解也更加深入。

公司规模: 初创企业
区域: 北美
行业: 科技
产品: API

工作簿测试

50%

在 Basis 的测试中,完成含 50 张工作表的税务工作簿,用时较 Sol 缩短。

内部评估

20%

Basis 内部评估得分的大致提升幅度。

正在加载…

Basis⁠(在新窗口中打开) 开发 AI 智能体,将会计人员日常的大量手动工作自动化,帮助他们从重复性任务中抽身,投入战略性工作。该公司的研究重点是让智能体可靠地完成耗时较长的任务。借助 GPT‑6 Astra,智能体能更好地理解会计人员希望达成的目标。

“GPT-6 Astra 能更透彻地理解用户的意图和所面临的问题。”
—Mitch Troyanovsky,Basis 联合创始人

用一半时间完成含 50 张工作表的税务工作簿

Basis 用一份包含 50 张工作表的复杂税务工作簿,对比了 GPT‑6 Astra 与 GPT‑5.6 Sol 的表现。任务要求准确、可靠地完成这份工作簿,而 GPT‑6 Astra 的速度明显更快。

“GPT-6 Astra 完成那份工作簿所需的时间,仅为 GPT-5.6 Sol 的一半。”
—Mitch Troyanovsky,Basis 联合创始人

Basis 还注意到,GPT‑6 Astra 在任务开始时就能做出更好的决策,帮助 Basis 的智能体以更直接的方式完成工作,减少纠错耗时。Troyanovsky 表示,这也提高了模型的 token 使用效率。

根据任务调整推理强度

Basis 还让 GPT‑6 Astra 随任务进展调整推理强度:遇到较难的步骤时增加计算量,步骤较简单时则减少计算量。模型在进行这些调整时,仍能保持缓存完整。Troyanovsky 表示,这有助于降低成本、缩短响应时间,让 Basis 及其客户能以更低的成本执行长时间运行的任务。

增强对实际应用的信心

采用 GPT‑6 Astra 后,Basis 的内部评估得分提升了约 20%。这得益于模型对用户意图的更好理解,包括何时提问、明确指出所做的假设,以及遵循指令。

Basis 会评估智能体的工作过程和最终答案,包括它们是否遵循模板、是否在处理税务问题时查阅一手资料,以及是否检查自己的工作。GPT‑6 Astra 能从更广泛的上下文中推断出这些要求,无需过多明确指示。

这减少了 Basis 针对具体情形逐一编写规则的需要,也让团队更有信心,相信智能体能够应对内部测试尚未覆盖的情况。

OpenAI 全方位赋能初创企业