Przejdź do treści głównej
OpenAI

Jak dbamy o bezpieczeństwo, zabezpieczenia i prywatność dotów

Gdy Twoje doty przejmują więcej pracy, pomagamy chronić Twoje informacje i dbać o to, by ważne decyzje pozostawały w Twoich rękach.

Ładowanie…

Doty to stale działający agenci, którzy przejmują bieżące obowiązki, dzięki czemu masz więcej czasu i uwagi na to, co dla Ciebie ważne. Każdy dot ma własny komputer i pracuje w aplikacjach, które zdecydujesz się połączyć. Wyznaczasz dotom cele i określasz, co mogą robić samodzielnie. Mogą realizować kolejne kroki, dostosowywać się do zmian i kontynuować pracę między rozmowami. Mogą śledzić rozwój wydarzeń i przygotowywać szkic newslettera lub pomagać w aktualizacji projektu w miarę napływu nowych informacji — przedstawiając Ci wyniki do sprawdzenia i prosząc Cię o decyzje wymagające Twojej oceny.

Powierzenie dotom tych obowiązków oznacza udostępnienie im większej ilości informacji i oddanie w ich ręce większej części swojej pracy. Ważne jest, by wiedzieć, do czego każdy dot ma dostęp, jak z niego korzysta i kiedy musi zwrócić się do Ciebie. To istotne kwestie, ponieważ błędy agenta mogą mieć konsekwencje wykraczające poza rozmowę: błędne zrozumienie prośby może doprowadzić do zmiany niewłaściwego pliku lub udostępnienia informacji, które miały pozostać prywatne.

Tworzymy zabezpieczenia obejmujące każdy element tej pracy. Zaczynamy od GPT‑6 Astra, który trenujemy tak, by rozumiał Twoje intencje i przestrzegał zasad bezpieczeństwa. Następnie dodajemy zabezpieczenia dotyczące informacji wykorzystywanych przez doty, środowisk ich pracy i planowanych działań. Chroniona przestrzeń robocza w chmurze pomaga ograniczać skutki błędów, bezpieczne procesy logowania pomagają chronić poufne dane uwierzytelniające, a niezależne kontrole działań pomagają wykrywać kroki niezgodne z Twoimi instrukcjami lub wymaganiami bezpieczeństwa. Ty wybierasz, co połączyć, określasz preferencje i na bieżąco śledzisz pracę lub zmieniasz jej kierunek.

Doty nadal mogą popełniać błędy, a my będziemy udoskonalać te zabezpieczenia na podstawie doświadczeń z rzeczywistego użytkowania. Poniżej wyjaśniamy, jak te zabezpieczenia ze sobą współdziałają, nad czym masz kontrolę i jakie ograniczenia nadal występują — aby ułatwić Ci świadome decyzje o pracy powierzanej dotom.

Model stworzony, by rozumieć, co masz na myśli

Doty korzystają z GPT‑6 Astra — naszego modelu o największych możliwościach i najlepiej dostosowanego do ludzkich intencji i wartości. Astra doskonale rozumie Twój cel, trzyma się zakresu prośby i zadaje konkretne pytania, gdy odpowiedzi mogą wpłynąć na to, co należy zrobić. Te zdolności pomagają dotom realizować długotrwałe zadania bez tracenia z oczu Twoich intencji.

Wytrenowaliśmy Astrę tak, by odmawiała realizacji szkodliwych próśb, w tym dotyczących nadużyć w dziedzinie biologii lub cyberbezpieczeństwa. Sprawdzamy, jak doty radzą sobie ze zmieniającymi się instrukcjami, niejednoznacznymi prośbami i próbami nakłonienia ich do przekroczenia przyznanych przez Ciebie uprawnień. Kontrolowane ataki, prowadzone przez ludzi i automatycznie, pomagają nam znajdować słabe punkty, ulepszać model i otaczające go systemy, a następnie ponownie testować wprowadzone zmiany.

Zabezpieczenia dla agentów zdolnych do działania

Te zabezpieczenia modelu uzupełniamy mechanizmami ochronnymi ChatGPT i dodatkowymi środkami dla agentów, którzy mogą stale pracować w Twoim imieniu.

Wbudowane zabezpieczenia ChatGPT obejmują szyfrowanie Twoich treści podczas przechowywania oraz przesyłania między Tobą, OpenAI i naszymi dostawcami usług, a także mechanizmy kontroli dostępu pomagające chronić przechowywane informacje. Nasze systemy ochrony kont wykrywają też podejrzane użycie Twojego konta OpenAI i mogą wymagać ponownego logowania, jeśli istnieje podejrzenie przejęcia sesji.

Agenci potrzebują też ochrony przed informacjami, na które trafiają podczas pracy. Strona internetowa, e-mail lub dokument mogą zawierać złośliwe instrukcje mające zmienić kierunek ich działań lub skłonić ich do udostępnienia prywatnych informacji — ten problem nazywamy wstrzykiwaniem poleceń. Łączymy zabezpieczenia modelu z ograniczeniami narzędzi, kontrolami przed wykonaniem działań i monitorowaniem, aby zapobiegać niepożądanym działaniom wywołanym przez takie treści.

Monitorujemy też doty podczas planowania i wykonywania działań, szukając potencjalnie szkodliwych zachowań, takich jak postępowanie wbrew Twoim instrukcjom lub próby obejścia zabezpieczeń. Jeśli system monitorowania bezpieczeństwa wykryje problem w bieżącej pracy dota, może ją wstrzymać i wyświetlić ostrzeżenie, z którym należy się zapoznać. To wbudowane monitorowanie pomaga wykrywać problemy w toku realizacji zadania i uzupełnia zabezpieczenia ograniczające dostęp i działania dotów.

Chroniona przestrzeń robocza dla każdego dota

Każdy dot ma własny komputer w chmurze, na którym może przeglądać internet, analizować informacje, tworzyć pliki i uruchamiać narzędzia. Doty mogą kontynuować pracę w tych przestrzeniach roboczych nawet bez Twojego aktywnego udziału.

Ty wybierasz, z których kont mogą korzystać doty — łącząc aplikacje w ramach uprawnień przyznanych ChatGPT lub logując się na stronie w przeglądarce dota, z użyciem bezpiecznego logowania tam, gdzie jest ono obsługiwane. Możesz też podłączyć swój komputer osobisty, aby doty mogły pomagać na więcej sposobów — na przykład analizować arkusz kalkulacyjny zapisany na pulpicie lub korzystać z narzędzi programistycznych zainstalowanych na Twoim urządzeniu.

W chronionej przestrzeni roboczej każdego dota izolacja w piaskownicy ogranicza dostępny mu kod i narzędzia, pomagając ograniczać skutki działania szkodliwego kodu lub błędnego polecenia. Izolujemy też środowiska chmurowe poszczególnych użytkowników od siebie oraz dbamy o ich bazowy system operacyjny Linux i przeglądarkę Chrome.

Doty uruchamiają kod w środowiskach oddzielonych od systemów, które koordynują ich pracę i egzekwują kluczowe zabezpieczenia. Mogą tam tworzyć pliki i uruchamiać narzędzia, ale nie mogą wykorzystać tego dostępu do zmiany systemów bezpieczeństwa ani wyłączenia wymaganych kontroli. Takie rozdzielenie pomaga utrzymać zabezpieczenia nawet wtedy, gdy dot popełni błąd.

Opisane poniżej zasady działania określają, co doty mogą robić z przyznanym im dostępem.

Przestrzeń robocza każdego dota w chmurze łączy jego komputer i dostępne mu narzędzia. Ty wybierasz, które aplikacje połączyć i czy podłączyć swój komputer osobisty. Automatyczna weryfikacja sprawdza działania wymagające kontroli, zanim zostaną wykonane. Jeśli zablokuje krok, podaje dotowi powód, by mógł zdecydować, co zrobić dalej.

Przestrzeń robocza każdego dota w chmurze łączy jego komputer i dostępne mu narzędzia. Ty wybierasz, które aplikacje połączyć i czy podłączyć swój komputer osobisty. Automatyczna weryfikacja sprawdza działania wymagające kontroli, zanim zostaną wykonane. Jeśli zablokuje krok, podaje dotowi powód, by mógł zdecydować, co zrobić dalej.

Bezpieczne logowanie

Bezpieczne logowanie pozwala dotom pracować na kontach bez umieszczania haseł w rozmowie. W przypadku obsługiwanych logowań model zostaje wstrzymany na czas wypełniania przez Ciebie bezpiecznego formularza. Formularz przesyła dane uwierzytelniające bezpośrednio do środowiska przeglądarki i używa ich do logowania bez ujawniania ich w kontekście modelu. Następnie dot wznawia pracę na zalogowanym koncie. Pozostawienie hasła poza rozmową zmniejsza ryzyko, że pojawi się ono w odpowiedzi lub zostanie udostępnione przez pomyłkę.

Obsługiwane procesy logowania zapisanym hasłem zachowują to rozdzielenie dzięki dedykowanej, szyfrowanej usłudze zarządzania danymi uwierzytelniającymi. Usługa dostarcza hasło do logowania bez przekazywania go modelowi. Dzięki temu doty mogą pracować na kontach, do których udzielisz dostępu, a hasła pozostają poza kontekstem modelu. Te zabezpieczenia dotyczą wyłącznie bezpiecznego logowania i korzystania z zapisanych haseł. Poufne dane umieszczone osobno w dostępnej do odczytu wiadomości lub dokumencie mogą nadal być widoczne dla modelu.

Bezpieczne logowanie w panelu unoszącym się na tle tapety dotów.

Kontroluj swoje informacje i śledź pracę

Zarządzasz dostępem dotów do aplikacji za pomocą istniejących połączeń i uprawnień ChatGPT, wspólnych dla ChatGPT, ChatGPT Work i Codex. W sekcji Wtyczki w Ustawieniach możesz przeglądać połączone konta i zmieniać zakres przyszłego dostępu dotów. Odłączenie aplikacji zatrzymuje udostępnianie nowych informacji przez to połączenie. Jednak informacje, które dot już poznał, pozostają w jego kontekście. Te uprawnienia regulują dostęp do Twoich aplikacji; nie znoszą obowiązkowych wymagań bezpieczeństwa.

Jeśli chcesz, by doty pracowały z lokalnymi plikami lub narzędziami, możesz też podłączyć swój komputer. To połączenie nadal podlega ograniczeniom lokalnej piaskownicy i odpowiednim kontrolom działań. Korzystanie z mikrofonu lub kamery komputera wymaga też uprawnień na urządzeniu, które możesz przyznać ChatGPT.

Uprawnienia aplikacji widoczne w ramce telefonu na tle tapety dotów.

Widok aktywności w aplikacji komputerowej pozwala śledzić bieżącą pracę i nią kierować. Pokazuje trwające i delegowane zadania oraz ich status. Możesz dodać kontekst, wyjaśnić nieporozumienie, zmienić kierunek pracy lub poprosić dota o zatrzymanie się.

Widok aktywności na zrzucie ekranu aplikacji komputerowej z zaokrąglonymi rogami, unoszącym się na tle tapety dotów.

Doty z czasem gromadzą kontekst, aby ich pomoc była bardziej przydatna. Gdy delegują pracę, inni agenci otrzymują instrukcje, by zachowywać informacje potrzebne do zadania i nie przechowywać zbędnych poufnych szczegółów. Każdy dot ma własny kontekst, który możesz w każdej chwili zresetować.

W przypadku przestrzeni roboczych ChatGPT Business, Enterprise i Edu domyślnie nie używamy Twoich danych do trenowania naszych modeli. W osobistych planach ChatGPT to Ty decydujesz, czy rozmowy z dotami i wykonywana przez nie praca są wykorzystywane do ulepszania naszych modeli — za pomocą ustawienia „Ulepszaj model dla wszystkich”. Gdy trenowanie modeli jest włączone, może ono obejmować działania dotów i skonfigurowane przez Ciebie automatyzacje, po podjęciu przez nas kroków w celu usunięcia danych umożliwiających identyfikację osób. Więcej o sposobach wykorzystania Twoich danych przeczytasz w tym artykule⁠(otwiera nowe okno) w naszym centrum pomocy.

Doty stale szukają sposobów, by pomóc

Oprócz zleconej przez Ciebie pracy doty mogą uruchamiać zadania zbierania informacji w tle, aby szukać innych sposobów pomocy — na przykład dostrzec zmianę w Twoich planach podróży. Nazywamy to proaktywnym zbieraniem informacji.

Te zadania są wykonywane w środowisku chmurowym każdego dota. Korzystają z narzędzi tylko do odczytu, by zbierać informacje z dozwolonych połączonych źródeł, a następnie zapisują prywatne notatki dla danego dota. Egzekwujemy te ograniczenia w kodzie: zadania zbierania informacji nie mogą bezpośrednio wysyłać wiadomości do innych osób, zmieniać treści w połączonych aplikacjach ani sterować przeglądarką lub pulpitem. Doty mogą wykorzystać te ustalenia, by zdecydować, jak pomóc, ale każde dalsze działanie musi podlegać standardowym zasadom i kontrolom.

Proaktywne zbieranie informacji odbywa się w tle, w środowisku chmurowym każdego dota. Zadanie to odczytuje dozwolone połączone źródła i przekazuje prywatne notatki dotowi, który decyduje, jak pomóc. Każde dalsze działanie podlega standardowym zasadom i kontrolom.

Proaktywne zbieranie informacji odbywa się w tle, w środowisku chmurowym każdego dota. Zadanie to odczytuje dozwolone połączone źródła i przekazuje prywatne notatki dotowi, który decyduje, jak pomóc. Każde dalsze działanie podlega standardowym zasadom i kontrolom.

Nie trenujemy naszych modeli bezpośrednio na wątkach zbierania informacji w tle ani na powstałych w ich ramach notatkach. Dot może jednak otrzymywać notatki ze swojego zadania zbierania informacji w tle lub odczytywać fragmenty powiązanych z nim wątków. Informacje wprowadzone w ten sposób do rozmowy lub zadania kwalifikujących się do wykorzystania w treningu mogą zostać użyte do trenowania modeli, zależnie od Twoich ustawień. Na przykład zadanie w tle może zbierać informacje o kilku miejscach na zbliżającą się podróż po Europie. Ten wątek i związane z nim notatki nie są bezpośrednio wykorzystywane do treningu. Później, gdy poprosisz dota o pomoc w zaplanowaniu podróży do Lizbony, może on odczytać notatkę o Lizbonie ze swojego zadania zbierania informacji w tle. Ta notatka staje się częścią kontekstu rozmowy o planowaniu podróży i może zostać wykorzystana do treningu, zależnie od Twoich ustawień. Pozostałe informacje zebrane w tle nie są wykorzystywane do treningu, chyba że również trafią do rozmowy lub zadania kwalifikujących się do takiego wykorzystania.

Jasne zasady podejmowania działań

Doty przestrzegają wbudowanych ograniczeń, które mają zapobiegać szkodom i pozostawiać decyzje o istotnych konsekwencjach w Twoich rękach. Ich zasady bezpieczeństwa wymagają odmawiania realizacji szkodliwych próśb, w tym dotyczących nadużyć w dziedzinie biologii lub cyberbezpieczeństwa. W przypadku zadań, w których mogą pomóc, zasady działania określają, kiedy mogą kontynuować, kiedy muszą poprosić o potwierdzenie, a kiedy pozostawić wykonanie kroku Tobie.

W tych granicach doty mogą odczytywać informacje, do których mają przyznany dostęp, analizować je i przygotowywać wersje robocze w Twoich rozmowach. Uczymy je, by przed wysłaniem wiadomości lub udostępnieniem pliku uzyskiwały zgodę obejmującą zarówno informacje, jak i typ odbiorcy — im bardziej wrażliwe dane, tym dokładniej trzeba określić odbiorców. Na przykład dane dotyczące zdrowia zawsze wymagają wskazania odbiorcy z nazwiska („udostępnij moją historię choroby dr. Thompsonowi”). Mniej wrażliwe dane osobowe, takie jak adres e-mail lub numer telefonu, domyślnie wymagają określenia kategorii odbiorców („dowolna linia lotnicza”). Użytkownik może dodatkowo rozszerzyć zasady dotyczące mniej wrażliwych danych osobowych („udostępniaj w dowolnym formularzu internetowym”), tworząc Regułę niestandardową — więcej informacji o tej funkcji znajduje się w następnej sekcji. Ta zgoda pozostaje związana z Twoimi instrukcjami dotyczącymi zadania; kontynuowanie pracy później ani jej delegowanie nie rozszerza jej zakresu.

Doty mogą dokonywać zakupów przy użyciu kart zapisanych wcześniej w witrynie sprzedawcy. Takie zakupy wymagają Twojej zgody.

Niektóre działania za każdym razem wymagają Twojego potwierdzenia. Należą do nich trwałe usuwanie danych, instalowanie lub uruchamianie oprogramowania z nierozpoznanego źródła oraz przyznawanie nowego dostępu istotnego dla bezpieczeństwa. Te wymagania dają Ci możliwość sprawdzenia zmian, które mogą być trudne do cofnięcia lub przyznać komuś nowy dostęp.

W przypadku innych wrażliwych czynności, takich jak zmiana hasła czy przelew między rachunkami finansowymi, doty mogą pomóc w pozostałej części zadania, ale te konkretne kroki muszą pozostawić Tobie.

Określ swoje preferencje za pomocą Reguł niestandardowych

Reguły niestandardowe pozwalają określić, jak doty mają pomagać w ramach wbudowanych zabezpieczeń — na przykład możesz zakazać im wysyłania e-maili. Możesz też przekazać wskazówki dotyczące konkretnego zadania, na przykład poprosić dota o poinformowanie współpracownika o Twojej nieobecności bez ujawniania prywatnego powodu. Te instrukcje nadal obowiązują, gdy dot deleguje pracę lub działa w tle.

Doty mogą pomóc Ci napisać Reguły niestandardowe, ale do ich zmiany potrzebują Twojej zgody. Te preferencje działają w ramach wbudowanych ograniczeń i nie mogą znieść obowiązkowych potwierdzeń, przekazywania kroków użytkownikowi ani podstawowych wymagań bezpieczeństwa.

Reguły niestandardowe widoczne w ramce telefonu na tle tapety dotów.

Niezależna kontrola, zanim doty zaczną działać

Zanim doty podejmą działania takie jak wysłanie e-maila czy zmiana plików, niezależny system bezpieczeństwa o nazwie Automatyczna weryfikacja sprawdza planowane kroki pod kątem zgodności z Twoimi instrukcjami, Regułami niestandardowymi i wymaganiami bezpieczeństwa. W przypadku e-maila sprawdza odbiorcę i treść wiadomości, aby pomóc wykryć niewłaściwy adres lub informacje, których nie zamierzasz udostępniać.

Jeśli Automatyczna weryfikacja zezwoli na dany krok, dot, który go zaproponował, wykonuje go przy użyciu odpowiedniego narzędzia na komputerze lub w aplikacji, a następnie wykorzystuje wynik do dalszej realizacji zadania. Może opierać się na Twojej wcześniejszej zgodzie, jeśli obejmuje ona dane działanie, a zasady nie wymagają nowego potwierdzenia.

Jeśli Automatyczna weryfikacja zablokuje krok, uniemożliwia wykonanie działania i podaje dotowi powód. Dot może poprosić o dodatkowe informacje lub Twoją zgodę, jeśli mogłoby to usunąć przyczynę blokady, a następnie ponownie przesłać krok do weryfikacji. Zależnie od przyczyny może zamiast tego spróbować dozwolonej alternatywy, pozostawić wrażliwy krok Tobie lub się zatrzymać. Twoja zgoda nie może znieść podstawowych wymagań bezpieczeństwa.

Mechanizmy wymuszające Automatyczną weryfikację utrzymujemy poza środowiskami, które doty mogą modyfikować, aby nie mogły zmienić ani wyłączyć wymaganej kontroli. Zwykłe kroki polegające wyłącznie na odczycie nadal podlegają uprawnieniom aplikacji, ograniczeniom narzędzi i innym zabezpieczeniom, ale nie wymagają tej dodatkowej weryfikacji.

Gdy Automatyczna weryfikacja zezwoli na działanie, dot je wykonuje i otrzymuje wynik. Gdy zablokuje działanie, przekazuje dotowi powód, a ten decyduje, czy zapytać Cię o zgodę lub dodatkowe informacje, spróbować dozwolonej alternatywy, pozostawić ten krok Tobie, czy się zatrzymać.

Gdy Automatyczna weryfikacja zezwoli na działanie, dot je wykonuje i otrzymuje wynik. Gdy zablokuje działanie, przekazuje dotowi powód, a ten decyduje, czy zapytać Cię o zgodę lub dodatkowe informacje, spróbować dozwolonej alternatywy, pozostawić ten krok Tobie, czy się zatrzymać.

Więcej pomocy, kontrola w Twoich rękach

Aby z zaufaniem powierzyć dotom bieżącą pracę, musisz wiedzieć, jak będą przestrzegać Twoich instrukcji i reagować na nieoczekiwane sytuacje. Astra pomaga im rozumieć Twoje intencje, a zabezpieczenia danych, przestrzeni roboczych, danych uwierzytelniających i działań pomagają ograniczać szkody wynikające z błędów lub złośliwych treści. Razem te zabezpieczenia pozwalają dotom wykonywać przydatną pracę, jednocześnie zmniejszając ryzyko, że błąd doprowadzi do niepożądanego działania lub ujawnienia informacji.

Ty wybierasz, z czym doty mogą się łączyć i jak mają pomagać. Możesz śledzić ich postępy lub zmieniać kierunek pracy wraz ze zmianą swoich potrzeb. Wymóg uzyskania zgody i pozostawianie niektórych kroków Tobie sprawiają, że kluczowe decyzje należą do Ciebie. Doty nadal mogą popełniać błędy, dlatego będziemy testować i udoskonalać ich zabezpieczenia na podstawie doświadczeń z rzeczywistego użytkowania. Naszym celem jest ułatwienie Ci powierzania pracy dotom i wracania do wymiernych postępów — tak, by Twoje preferencje wyznaczały kierunek zadania, a ważne decyzje nadal pozostawały w Twoich rękach.

Dowiedz się więcej

Przeczytaj kartę systemu⁠(otwiera nowe okno), aby poznać szczegóły naszych zabezpieczeń, ocen bezpieczeństwa i pozostałych ograniczeń.

Podstawy zabezpieczeń ChatGPT opisujemy w artykule Bezpieczeństwo i prywatność w OpenAI. Jedno z zabezpieczeń internetowych omawiamy szerzej w artykule Jak chronimy Twoje dane, gdy agent AI klika link.

Autorzy

OpenAI