Przejdź do treści głównej
OpenAI

21 sierpnia 2025

Jak Blue J szybko rośnie w złożonych, regulowanych branżach

Blue J rozszerzyło działalność na trzy kraje i ponad 3000 firm dzięki koncentracji, wiedzy branżowej i odpowiedniemu modelowi OpenAI.

Białe logo Blue J wyśrodkowane na abstrakcyjnym tle.
Rozmiar przedsiębiorstwa: Start-up
Region: Ameryka Północna
Branża: Technologia
Produkty: ChatGPT, API

2,7

Godziny oszczędzane tygodniowo przez użytkownika

1/700

Kwestionowana jest mniej niż 1 na 700 odpowiedzi

Ładowanie…

Tradycyjne badania podatkowe zaczynają się od przeglądania setek źródeł, zanim jeszcze rozpocznie się ich interpretacja. Specjaliści podatkowi spędzają następnie wiele godzin na analizowaniu ustaw, rozporządzeń, interpretacji, orzecznictwa i komentarzy ekspertów, aby ustalić wzajemne zależności między przepisami i sformułować odpowiedź.

W zależności od złożoności pytania proces ten może trwać godziny, dni, a nawet tygodnie, a mimo to przynieść niespójne lub nieaktualne wyniki. Każdy pominięty niuans może mieć realne konsekwencje finansowe.

Blue J powstało w 2015 roku z inicjatywy wykładowców prawa podatkowego i praktyków, którzy dostrzegli potrzebę stworzenia lepszych narzędzi do badań podatkowych. Bazując na pierwszych próbach wykorzystania AI do przewidywania rozstrzygnięć spraw podatkowych, zespół opracował szereg produktów wspierających firmy podatkowe i księgowe każdej wielkości.

Po premierze ChatGPT zespół Blue J dostrzegł szansę na stworzenie czegoś nowego: połączenie zaawansowanego rozumowania na podstawie złożonych przepisów z ustrukturyzowanym wyszukiwaniem, aby w kilka sekund dostarczać eksperckie odpowiedzi podatkowe wraz z odwołaniami w tekście i wykazami wiarygodnych źródeł.

W ciągu dwóch lat od premiery Blue J wprowadziło opartą na GPT‑4.1 wyszukiwarkę informacji podatkowych w Stanach Zjednoczonych, Kanadzie i Wielkiej Brytanii. Pierwszy produkt uruchomiono zaledwie sześć miesięcy po debiucie ChatGPT, a następnie szybko go rozwijano, wyciągając wnioski z opinii użytkowników i tworząc solidne ramy oceny.

Obecnie ponad 70% użytkowników loguje się co tydzień, a kwestionowana jest mniej niż 1 na 700 odpowiedzi. Blue J podzieliło się wnioskami z wejścia na złożony rynek i szybkiego skalowania działalności dzięki bezkompromisowemu podejściu do zaufania, dokładności i szybkości.

„Działaliśmy szybko, ponieważ znaliśmy już problem i wiedzieliśmy, jak go rozwiązać. OpenAI zapewniło nam model o jakości potrzebnej do wykorzystania tej wiedzy na dużą skalę”.
—Brett Janssen, dyrektor ds. technologii w Blue J

Wykorzystanie wiedzy branżowej do stworzenia wyjątkowego rozwiązania

Rozwiązanie Blue J do badań podatkowych wykorzystuje system generowania wspomaganego wyszukiwaniem (RAG), który łączy GPT‑4.1 z własną biblioteką milionów starannie wybranych dokumentów, w tym wiarygodnych źródeł pierwotnych oraz komentarzy ekspertów z takich serwisów jak Tax Notes.

Gdy użytkownik zada pytanie podatkowe, na przykład: „Czym jest pułapka SALT wynikająca z OBBBA i jak można ograniczyć jej skutki?” Blue J natychmiast wyszukuje materiały źródłowe, a GPT‑4.1 tworzy na ich podstawie jasną odpowiedź z pełnymi odwołaniami. Przypomina ona bardziej poradę zaufanego współpracownika niż wynik wygenerowany przez model. Taki system mógł stworzyć tylko zespół doskonale znający zarówno podatki, jak i technologię.

„Przetestowaliśmy wiele modeli, ale to GPT‑4.1 konsekwentnie robi dokładnie to, czego potrzebujemy” — mówi Janssen. „Wykonuje polecenia, uwzględnia kontekst i radzi sobie z nietypowymi przypadkami lepiej niż wszystko, co dotąd widzieliśmy”.

Budowanie zaufania na dużą skalę dzięki opiniom użytkowników

W podatkach nawet drobne błędy mogą spowodować kontrolę, opóźnić złożenie deklaracji lub narazić klientów na realne straty finansowe. Zespół Blue J wiedział z doświadczenia, że nawet rzadkie, nietypowe przypadki mogą podważyć zaufanie, jeśli nie zostaną szybko wykryte i naprawione. Dlatego od samego początku zaprojektowano produkt tak, aby gromadził opinie i umożliwiał doskonalenie na dużą skalę pod kierunkiem zespołu ekspertów ds. badań podatkowych.

Aby system stawał się lepszy z każdym użyciem, Blue J wprowadziło opcjonalne udostępnianie danych dla klientów, którzy chcieli pomóc w ulepszaniu produktu. Każda odpowiedź Blue J zawiera przycisk „Nie zgadzam się”. Po jego wybraniu odpowiedź jest systematycznie klasyfikowana według rodzaju problemu, zagadnienia podatkowego i prawdopodobnej przyczyny źródłowej.

Ten mechanizm wychwytuje pojedyncze błędy i ujawnia powtarzające się wzorce. Jeśli zapytania dotyczące opodatkowania spółek osiągają słabsze wyniki, zespół bada przyczynę. Jeśli polecenie generuje niespójne odpowiedzi, zespół je dostraja. GPT‑4.1 obsługuje tę warstwę selekcji, analizując tysiące opinii, grupując powiązane problemy i pomagając zespołom Blue J ds. produktu i badań podatkowych skupić się na działaniach, które przyniosą największe efekty.

Wykres słupkowy zatytułowany „BlueJ” na jasnym tle, przedstawiający wskaźniki wydajności za pomocą niebieskich i szarych słupków w wielu kategoriach.

Ponieważ GPT‑4.1 odpowiada w spójny sposób, nawet drobne ulepszenia z czasem przynoszą coraz większe korzyści. W rezultacie system uczy się na podstawie każdej interakcji, co pozwala szybciej wprowadzać zmiany, podnosi jakość odpowiedzi i rozwijać produkt zgodnie z potrzebami użytkowników. Ten samonapędzający się mechanizm pomógł Blue J obniżyć odsetek kwestionowanych odpowiedzi do mniej niż 1 na 700.

Iteracyjne rozwijanie produktu pomaga również Blue J wyprzedzać zmiany. Gdy w 2025 roku w Stanach Zjednoczonych uchwalono szeroko zakrojoną ustawę podatkową, zespół już od sześciu tygodni analizował jej wpływ na bazę kodu. W ciągu kilku godzin od podpisania ustawy użytkownicy otrzymywali już zaktualizowane odpowiedzi w środowisku produkcyjnym.

W dziedzinie, w której przepisy się zmieniają, a precyzja jest kluczowa, ten system zamkniętej pętli pozwala Blue J działać szybko, utrzymywać zaufanie i wyprzedzać rynek.

Projektowanie ocen, które podnoszą poprzeczkę, a nie tylko sprawdzają jej poziom

Jakość modelu nie jest tylko jedną z funkcji — stanowi warunek dopuszczenia produktu. Blue J ocenia każdą nową wersję modelu za pomocą zestawu testów porównawczych obejmującego ponad 350 poleceń z zakresu prawa podatkowego Stanów Zjednoczonych, Kanady i Wielkiej Brytanii. podatkowego. Każdy model jest testowany pod kątem wykonywania poleceń, zgodności ze źródłami i jasności odpowiedzi. Dzięki temu ulepszenia poleceń lub logiki wyszukiwania przekładają się na przewidywalne działanie w rzeczywistych zastosowaniach.

„Choć przetestowaliśmy je wszystkie, nigdy nie wdrożyliśmy modelu spoza OpenAI” — mówi Janssen. „Modele OpenAI konsekwentnie osiągały lepsze wyniki w naszych wewnętrznych testach porównawczych, zwłaszcza pod względem wykonywania poleceń i udzielania odpowiedzi spełniających nasze wymagania dotyczące rzeczywistych zastosowań”.

Wykorzystaj wiedzę branżową jako swoją przewagę

Klienci korzystają z Blue J jako podstawowego narzędzia do badań podatkowych przez cały rok, a nie tylko w sezonie rozliczeń. Ponad 70% użytkowników loguje się co tydzień, oszczędzając średnio 2,7 godziny tygodniowo na osobę przy badaniach i komunikacji z klientami. Ten czas przeznaczają na bardziej dochodowe planowanie i doradztwo.

Blue J osiągnęło taki poziom zaangażowania, koncentrując się na tym, co zna najlepiej: rzeczywistych potrzebach specjalistów podatkowych. GPT‑4.1 wzmacnia ich wiedzę dzięki ustrukturyzowanym danym wyjściowym, konsekwentnemu wykonywaniu poleceń i wiarygodnym wynikom. Wniosek dla założycieli firm jest jasny: wykorzystajcie swoją specjalistyczną wiedzę jako główną przewagę, a odpowiednie modele — do skalowania działalności.