GPT‑6 Astra로 세무 통합 문서를 2배 빠르게 완성하는 Basis
GPT‑6 Astra는 GPT‑5.6 Sol보다 복잡한 작업을 완료하는 데 걸리는 시간을 50% 줄이고, 사용자의 의도를 더 깊이 이해하는 모습을 보였습니다.
통합 문서 테스트
50%
Basis 테스트에서 Sol 대비 탭 50개짜리 세무 통합 문서 완성에 걸리는 시간 단축률.
내부 평가
20%
Basis 내부 평가 점수의 대략적인 향상률.
Basis(새 창에서 열기)는 회계사가 매일 수작업으로 처리하는 업무의 상당 부분을 자동화하는 AI 에이전트를 개발합니다. 이를 통해 회계사가 반복적인 업무 대신 전략적인 업무에 시간을 쓸 수 있도록 돕습니다. Basis는 장시간이 걸리는 작업을 안정적으로 완수하는 에이전트를 연구하는 데 주력하고 있습니다. GPT‑6 Astra를 도입하면서 에이전트가 회계사의 업무 목표를 더 잘 이해하는 모습을 확인하고 있습니다.
“GPT-6 Astra는 사용자의 의도와 문제를 훨씬 더 깊이 이해합니다.”
Basis는 탭이 50개인 복잡한 세무 통합 문서를 사용해 GPT‑6 Astra와 GPT‑5.6 Sol을 비교했습니다. 통합 문서를 정확하고 안정적으로 완성하는 과제에서 GPT‑6 Astra는 눈에 띄게 더 빨랐습니다.
“GPT-6 Astra는 GPT-5.6 Sol이 걸리는 시간의 절반 만에 해당 통합 문서를 완성할 수 있습니다.”
Basis는 GPT‑6 Astra가 작업 초기에 더 나은 판단을 내린다는 점에도 주목했습니다. 덕분에 Basis의 에이전트는 실수를 바로잡는 데 시간을 덜 쓰고, 불필요한 과정을 줄여 업무를 처리할 수 있습니다. 트로야노브스키는 이 덕분에 모델이 토큰도 더 효율적으로 사용한다고 설명합니다.
Basis는 작업이 진행되는 동안 GPT‑6 Astra가 추론에 들이는 자원도 조절하도록 합니다. 어려운 단계에서는 연산량을 늘리고, 쉬운 단계에서는 줄이는 방식입니다. 모델은 캐시를 그대로 유지하면서도 이러한 조절을 할 수 있습니다. 트로야노브스키는 이 기능이 비용과 응답 시간을 줄여, Basis와 고객이 장시간이 걸리는 작업을 더 경제적으로 처리할 수 있게 해준다고 말합니다.
Basis는 GPT‑6 Astra 도입으로 내부 평가 점수가 약 20% 향상되는 결과를 얻었습니다. 언제 질문하고, 가정한 내용을 명시하고, 지시를 따라야 하는지 등 사용자의 의도를 더 잘 이해한 덕분입니다.
Basis는 에이전트의 작업 과정과 최종 답변을 평가합니다. 템플릿을 따르는지, 세무 관련 질문에 답할 때 1차 자료를 참고하는지, 스스로 작업 결과를 점검하는지 등을 살펴봅니다. GPT‑6 Astra는 명시적인 지시가 적어도 더 넓은 맥락에서 이러한 기대 사항을 추론할 수 있습니다.
덕분에 Basis는 개별 상황마다 규칙을 작성할 필요가 줄었습니다. 또한 내부 테스트에서 다루지 않은 상황도 에이전트가 처리할 수 있다는 팀의 확신이 커졌습니다.


