Langkau ke kandungan utama
OpenAI

21 Ogos 2025

Cara pendekatan Blue J berkembang pantas, domain rumit terkawal

Blue J berkembang ke tiga negara dan lebih daripada 3,000 firma, terima kasih kepada fokus, kepakaran bidang yang mendalam dan model OpenAI yang tepat.

Logo Blue J berwarna putih di tengah-tengah latar abstrak.
Saiz syarikat: Syarikat permulaan
Rantau: Amerika Utara
Industri: Teknologi
Produk: ChatGPT, API

2.7

Jam dijimatkan setiap pengguna setiap minggu

1/700

Kurang daripada 1 dalam 700 jawapan dipertikaikan

Memuat…

Penyelidikan cukai tradisional bermula dengan meneliti ratusan sumber sebelum tafsiran dapat dilakukan. Pakar cukai kemudian menghabiskan masa berjam-jam meneliti statut, peraturan, ketetapan, undang-undang kes dan ulasan pakar untuk memahami interaksi antara peraturan lalu merumuskannya sebagai jawapan.

Bergantung pada kerumitan soalan, proses ini boleh mengambil masa berjam-jam, berhari-hari atau berminggu-minggu—dan masih menghasilkan keputusan yang tidak konsisten atau lapuk, sedangkan setiap perincian yang terlepas membawa kos sebenar.

Blue J diasaskan pada tahun 2015 oleh profesor dan pengamal undang-undang cukai yang menyedari perlunya alat penyelidikan cukai yang lebih baik. Berdasarkan penerokaan awal penggunaan AI untuk meramalkan keputusan kes undang-undang cukai, pasukan itu kemudiannya membangunkan pelbagai produk bagi menyokong firma cukai dan perakaunan dalam semua saiz.

Apabila ChatGPT dilancarkan, Blue J melihat peluang untuk mencipta sesuatu yang baharu: menggabungkan penaakulan lanjutan terhadap peraturan yang padat dengan pemerolehan berstruktur bagi menyediakan jawapan cukai bertaraf pakar dalam beberapa saat, lengkap dengan petikan dalam teks dan senarai sumber yang boleh dipercayai oleh pakar.

Dalam tempoh dua tahun selepas pelancarannya, Blue J memperkenalkan enjin penyelidikan cukai dengan GPT‑4.1 di seluruh A.S., Kanada dan U.K. Mereka melancarkan produk pertama hanya enam bulan selepas kemunculan ChatGPT, kemudian menambah baiknya dengan pantas berdasarkan maklum balas sambil membina rangka kerja penilaian yang mantap.

Kini, lebih 70% pengguna log masuk setiap minggu, dengan kadar tidak setuju kurang daripada 1 bagi setiap 700 respons. Blue J berkongsi pengajaran tentang cara menembusi bidang yang kompleks dan berkembang pantas dengan menjadikan kepercayaan, ketepatan dan kepantasan sebagai perkara yang tidak boleh dikompromikan.

“Kami bergerak pantas kerana kami sudah memahami masalah tersebut dan cara menyelesaikannya. OpenAI memberi kami kualiti model yang diperlukan untuk memperluas kepakaran itu.”
—Brett Janssen, CTO Blue J

Meningkatkan kepakaran bidang untuk membina penyelesaian yang tiada tandingan

Penyelesaian penyelidikan cukai Blue J dibina menggunakan sistem Penjanaan Dapatan Terimbuh (RAG), yang menggabungkan GPT‑4.1 dengan pustaka proprietari berisi jutaan dokumen pilihan, termasuk sumber primer berwibawa dan ulasan pakar daripada sumber seperti Tax Notes.

Apabila pengguna mengajukan soalan cukai seperti, “Apakah torpedo SALT yang diwujudkan oleh OBBBA dan bagaimanakah kesannya boleh dikurangkan?” Blue J mendapatkan bahan sumber dengan serta-merta, lalu GPT‑4.1 menyusunnya menjadi jawapan jelas dengan petikan lengkap yang terasa seperti panduan daripada rakan sekerja yang dipercayai, bukannya output model. Sistem ini hanya dapat dibina oleh pasukan yang benar-benar memahami bidang cukai dan teknologi.

“Kami telah menguji banyak model dan GPT‑4.1 ialah model yang sentiasa melakukan perkara yang kami perlukan,” kata Janssen. “Model ini mematuhi arahan, mengambil kira konteks dan menangani kes pinggiran dengan lebih baik berbanding apa-apa yang pernah kami lihat.”

Memperluas kepercayaan melalui maklum balas pengguna

Dalam bidang cukai, kesilapan kecil sekalipun boleh mencetuskan audit, melambatkan pemfailan atau menyebabkan pelanggan menanggung kerugian sebenar. Berdasarkan pengalaman, pasukan Blue J tahu bahawa kes pinggiran yang jarang berlaku sekalipun boleh menjejaskan kepercayaan jika tidak dikesan dan diperbetulkan dengan pantas. Oleh itu, sejak hari pertama mereka mereka bentuk produk untuk mengumpulkan maklum balas dan menambah baiknya pada skala besar, berpandukan kepakaran pasukan penyelidikan cukai mereka.

Untuk meningkatkan sistem setiap kali digunakan, Blue J memperkenalkan perkongsian data pilihan bagi pelanggan yang mahu menyumbang kepada penambahbaikan produk. Setiap jawapan Blue J mempunyai butang ‘tidak setuju’. Apabila ditandai, respons itu dikategorikan secara sistematik mengikut jenis isu, topik cukai dan kemungkinan punca utama.

Kitaran ini mengesan kesilapan terpencil dan mendedahkan pola. Jika prestasi pertanyaan cukai perkongsian kurang baik, pasukan akan menyiasatnya. Jika sesuatu prom menghasilkan pelengkapan yang tidak konsisten, mereka akan melaraskannya. GPT‑4.1 menguasakan lapisan triage ini dengan menganalisis ribuan maklum balas, mengelompokkan isu berkaitan dan membantu pasukan produk serta penyelidikan cukai Blue J menumpukan usaha pada perkara yang memberi impak terbesar.

Carta bar bertajuk “BlueJ” pada latar cerah yang menunjukkan metrik prestasi dengan bar biru dan kelabu merentas pelbagai kategori.

Oleh sebab GPT‑4.1 memberikan respons secara konsisten, penambahbaikan kecil sekalipun menghasilkan kesan berganda. Hasilnya ialah sistem yang belajar daripada setiap interaksi, mempercepat lelaran, jawapan yang berkualiti tinggi dan membolehkan produk berkembang seiring dengan keperluan pengguna. Kitaran pengukuhan ini membantu Blue J mengurangkan kadar tidak setuju kepada kurang daripada 1 bagi setiap 700 jawapan.

Pembangunan produk secara berulang ini turut membantu Blue J mendahului perubahan. Apabila rang undang-undang cukai A.S. yang menyeluruh diluluskan pada tahun 2025, pasukan itu sudah meluangkan masa enam minggu untuk memetakan kesannya terhadap seluruh pangkalan kod. Dalam beberapa jam selepas rang undang-undang itu ditandatangani, pengguna sudah menerima jawapan terkini dalam persekitaran produksi.

Dalam bidang yang peraturannya sentiasa berubah dan ketepatan sangat penting, sistem gelung tertutup inilah yang memastikan Blue J kekal pantas, dipercayai dan mendahului pasaran.

Reka penilaian yang meningkatkan standard, bukan sekadar mengujinya

Kualiti model bukan sekadar ciri, malah merupakan syarat kelayakan. Blue J menilai setiap keluaran model baharu menggunakan set penanda aras lebih 350 prom yang merangkumi undang-undang cukai A.S., Kanada dan U.K. Setiap model diuji dari segi pematuhan arahan, keselarasan sumber dan kejelasan jawapan, bagi memastikan penambahbaikan pada prom atau logik pemerolehan diperkukuh oleh tingkah laku dunia sebenar yang boleh diramal.

“Walaupun kami telah menguji semuanya, kami tidak pernah melancarkan model selain model OpenAI,” kata Janssen. “Model OpenAI secara konsisten mengatasi penanda aras dalaman kami, terutamanya dalam mematuhi arahan dan memberikan jawapan yang memenuhi standard penggunaan dunia sebenar kami.”

Jadikan kepakaran domain anda sebagai kelebihan

Pelanggan bergantung pada Blue J sebagai alat penyelidikan cukai utama mereka sepanjang tahun, bukan hanya pada musim cukai. Lebih 70% pengguna mendaftar masuk setiap minggu dan menjimatkan 2.7 jam bagi setiap pengguna seminggu untuk penyelidikan serta komunikasi pelanggan—masa yang dilaburkan semula dalam kerja perancangan dan khidmat nasihat dengan margin lebih tinggi.

Blue J mencapai tahap penglibatan itu dengan menumpukan pada perkara yang paling mereka fahami: keperluan sebenar pakar cukai. GPT‑4.1 memperkukuh kepakaran mereka melalui output berstruktur, pematuhan arahan yang konsisten dan hasil yang boleh dipercayai. Bagi pengasas, kesimpulannya jelas: jadikan kepakaran khusus anda sebagai kelebihan teras dan gunakan model yang tepat untuk berkembang.