Bỏ qua nội dung chính
OpenAI

21 tháng 8, 2025

Cách Blue J tăng tốc ở lĩnh vực phức tạp, chịu quản lý

Blue J mở rộng đến ba quốc gia và hơn 3.000 công ty nhờ sự tập trung, chuyên môn sâu và mô hình OpenAI phù hợp.

Logo Blue J màu trắng nằm giữa nền trừu tượng.
Quy mô công ty: Công ty khởi nghiệp
Khu vực: Bắc Mỹ
Ngành: Công nghệ
Sản phẩm: ChatGPT, API

2,7

Số giờ mỗi người dùng tiết kiệm hằng tuần

1/700

Chưa đến 1 trong 700 câu trả lời bị phản đối

Đang tải…

Theo cách truyền thống, nghiên cứu thuế bắt đầu bằng việc sàng lọc hàng trăm nguồn tài liệu trước cả khi diễn giải chúng. Sau đó, chuyên gia thuế mất hàng giờ phân tích luật thành văn, quy định, phán quyết, án lệ và bình luận chuyên môn để xâu chuỗi cách các quy tắc tương tác rồi đúc kết thành câu trả lời.

Tùy độ phức tạp của câu hỏi, quá trình này có thể kéo dài hàng giờ, nhiều ngày, thậm chí nhiều tuần—mà kết quả vẫn có thể thiếu nhất quán hoặc lỗi thời; mỗi sắc thái bị bỏ sót đều gây tổn thất thực tế.

Blue J được thành lập năm 2015 bởi các giáo sư luật thuế và chuyên gia thực hành, những người nhận thấy cần có công cụ nghiên cứu thuế tốt hơn. Từ những thử nghiệm ban đầu về việc ứng dụng AI để dự đoán kết quả các vụ án thuế, đội ngũ tiếp tục phát triển nhiều sản phẩm hỗ trợ các công ty thuế và kế toán thuộc mọi quy mô.

Khi ChatGPT ra mắt, Blue J nhận thấy cơ hội tạo ra một sản phẩm mới: kết hợp khả năng suy luận nâng cao trên các quy định phức tạp với cơ chế truy xuất có cấu trúc để cung cấp câu trả lời về thuế ở cấp độ chuyên gia chỉ trong vài giây, kèm trích dẫn ngay trong nội dung và danh sách nguồn đáng tin cậy cho giới chuyên môn.

Trong vòng hai năm sau khi ra mắt, Blue J đã triển khai công cụ nghiên cứu thuế sử dụng GPT‑4.1 tại Hoa Kỳ, Canada và Vương quốc Anh. Họ ra mắt sản phẩm đầu tiên chỉ sáu tháng sau khi ChatGPT xuất hiện, rồi nhanh chóng cải tiến qua nhiều vòng, học hỏi từ phản hồi và xây dựng một khuôn khổ đánh giá vững chắc.

Hiện nay, hơn 70% người dùng đăng nhập hằng tuần và chưa đến 1 trong 700 câu trả lời bị phản đối. Blue J chia sẻ những bài học về cách thâm nhập một lĩnh vực phức tạp và mở rộng nhanh chóng bằng việc coi độ tin cậy, tính chính xác và tốc độ là những yêu cầu không thể thỏa hiệp.

“Chúng tôi tiến rất nhanh vì đã hiểu rõ vấn đề và cách giải quyết. OpenAI mang đến chất lượng mô hình cần thiết để chúng tôi mở rộng chuyên môn đó trên quy mô lớn.”
—Brett Janssen, Giám đốc công nghệ của Blue J

Tận dụng chuyên môn ngành để xây dựng giải pháp không ai khác có thể tạo ra

Giải pháp nghiên cứu thuế của Blue J được xây dựng trên hệ thống Tạo sinh tăng cường truy xuất (RAG), kết hợp GPT‑4.1 với thư viện độc quyền gồm hàng triệu tài liệu tuyển chọn, trong đó có các nguồn sơ cấp chính thống và bình luận chuyên môn từ những nguồn như Tax Notes.

Khi người dùng đặt một câu hỏi về thuế như: “Bẫy SALT do OBBBA tạo ra là gì và có thể giảm thiểu bằng cách nào?”, Blue J lập tức truy xuất tài liệu nguồn, còn GPT‑4.1 tổng hợp chúng thành một câu trả lời rõ ràng, có trích dẫn đầy đủ, giống lời tư vấn từ một đồng nghiệp đáng tin cậy hơn là đầu ra của mô hình. Đây là hệ thống mà chỉ một đội ngũ am hiểu cả thuế lẫn công nghệ mới có thể xây dựng.

“Chúng tôi đã thử nghiệm nhiều mô hình và GPT‑4.1 là mô hình luôn đáp ứng được những gì chúng tôi cần”, Janssen cho biết. “Mô hình này tuân thủ hướng dẫn, tôn trọng ngữ cảnh và xử lý các trường hợp ngoại lệ tốt hơn bất kỳ mô hình nào khác mà chúng tôi từng thấy.”

Mở rộng niềm tin nhờ phản hồi của người dùng

Trong lĩnh vực thuế, ngay cả sai sót nhỏ cũng có thể dẫn đến kiểm toán, làm chậm việc khai thuế hoặc khiến khách hàng thiệt hại thực tế. Từ kinh nghiệm thực tế, đội ngũ Blue J hiểu rằng ngay cả những trường hợp ngoại lệ hiếm gặp cũng có thể làm xói mòn niềm tin nếu không được phát hiện và khắc phục nhanh chóng. Vì vậy, ngay từ đầu, họ đã thiết kế sản phẩm để thu thập phản hồi và cải thiện trên quy mô lớn dưới sự định hướng chuyên môn của đội ngũ nghiên cứu thuế.

Để hệ thống trở nên tốt hơn sau mỗi lần sử dụng, Blue J cung cấp tùy chọn chia sẻ dữ liệu cho những khách hàng muốn góp phần cải thiện sản phẩm. Mỗi câu trả lời của Blue J đều có nút “Phản đối”; khi bị gắn cờ, câu trả lời sẽ được phân loại có hệ thống theo loại vấn đề, chủ đề thuế và nguyên nhân gốc rễ có khả năng nhất.

Vòng phản hồi này vừa phát hiện lỗi đơn lẻ vừa làm rõ các xu hướng. Nếu các truy vấn về thuế hợp danh có kết quả kém, đội ngũ sẽ điều tra. Nếu một câu lệnh tạo ra các kết quả không nhất quán, họ sẽ tinh chỉnh câu lệnh đó. GPT‑4.1 vận hành lớp phân loại ưu tiên này bằng cách phân tích hàng nghìn phản hồi, nhóm các vấn đề liên quan và giúp đội ngũ sản phẩm cùng đội ngũ nghiên cứu thuế của Blue J tập trung nguồn lực vào những nơi tạo ra tác động lớn nhất.

Biểu đồ cột có tiêu đề “BlueJ” trên nền sáng, thể hiện các chỉ số hiệu suất bằng cột màu xanh lam và xám trong nhiều hạng mục.

Vì GPT‑4.1 phản hồi nhất quán nên ngay cả những cải tiến nhỏ cũng tích lũy thành kết quả đáng kể. Kết quả là một hệ thống học hỏi từ mọi lượt tương tác, giúp đẩy nhanh chu kỳ cải tiến, nâng cao chất lượng câu trả lời và phát triển sản phẩm đồng bộ với nhu cầu người dùng. Vòng lặp tăng trưởng này giúp Blue J giảm tỷ lệ phản đối xuống dưới 1 trên mỗi 700 câu trả lời.

Quy trình phát triển sản phẩm theo vòng lặp cũng giúp Blue J đi trước những thay đổi. Khi một dự luật thuế có phạm vi sâu rộng được thông qua tại Hoa Kỳ vào năm 2025, đội ngũ đã dành sáu tuần để lập bản đồ tác động của dự luật lên toàn bộ mã nguồn. Chỉ vài giờ sau khi dự luật được ký, người dùng đã thấy các câu trả lời cập nhật trên hệ thống chính thức.

Trong một lĩnh vực mà quy định liên tục thay đổi và độ chính xác là yếu tố sống còn, chính hệ thống vòng kín này giúp Blue J duy trì tốc độ, độ tin cậy và vị thế dẫn đầu thị trường.

Thiết kế các bài đánh giá để nâng chuẩn, không chỉ kiểm tra theo chuẩn

Chất lượng mô hình không chỉ là một tính năng mà còn là điều kiện tiên quyết. Blue J đánh giá từng phiên bản mô hình mới bằng một bộ chuẩn gồm hơn 350 câu lệnh về luật thuế của Hoa Kỳ, Canada và Vương quốc Anh. Mỗi mô hình đều được kiểm tra về khả năng tuân thủ hướng dẫn, bám sát nguồn và trình bày câu trả lời rõ ràng, qua đó bảo đảm các cải tiến đối với câu lệnh hoặc logic truy xuất được củng cố bằng hành vi ổn định trong thực tế.

“Dù đã thử nghiệm tất cả, chúng tôi chưa bao giờ phát hành sản phẩm dùng mô hình không phải của OpenAI”, Janssen cho biết. “Các mô hình OpenAI luôn vượt trội trong những bài đánh giá nội bộ của chúng tôi, đặc biệt về khả năng tuân thủ hướng dẫn và đưa ra câu trả lời đáp ứng tiêu chuẩn sử dụng trong thực tế.”

Biến chuyên môn ngành thành lợi thế của bạn

Khách hàng dùng Blue J làm công cụ nghiên cứu thuế mặc định quanh năm, chứ không chỉ trong mùa khai thuế. Hơn 70% người dùng đăng nhập hằng tuần, mỗi người tiết kiệm 2,7 giờ mỗi tuần cho việc nghiên cứu và trao đổi với khách hàng—thời gian mà họ tái đầu tư vào công việc hoạch định và tư vấn có biên lợi nhuận cao hơn.

Blue J đạt được mức độ gắn kết đó nhờ tập trung vào điều họ am hiểu nhất: nhu cầu thực tế của các chuyên gia thuế. GPT‑4.1 khuếch đại chuyên môn của họ nhờ đầu ra có cấu trúc, khả năng tuân thủ hướng dẫn nhất quán và kết quả đáng tin cậy. Bài học dành cho các nhà sáng lập rất rõ ràng: hãy biến chuyên môn riêng thành lợi thế cốt lõi và sử dụng đúng mô hình để mở rộng quy mô.