OpenAI - office

ChatGPT dostaje „tryb lockdown”. W obawie przed nowym rodzajem ataków

OpenAI wzmacnia bezpieczeństwo użytkowników pracujących z wrażliwymi danymi. Nowa funkcja ma chronić przed ukrytymi atakami na ChatGPT.

OpenAI zapowiedziało nową funkcję bezpieczeństwa o nazwie Lockdown Mode, która ma ograniczyć ryzyko tzw. ataków typu prompt injection. To coraz częściej dyskutowany problem związany z wykorzystaniem sztucznej inteligencji, w którym złośliwe instrukcje są ukrywane w stronach internetowych, dokumentach lub innych źródłach danych analizowanych przez modele AI.

Nowy tryb nie jest przeznaczony dla wszystkich użytkowników. Według OpenAI został stworzony przede wszystkim z myślą o osobach i organizacjach pracujących na poufnych informacjach. Takich, dla których priorytetem jest maksymalne ograniczenie ryzyka wycieku danych.

Czym są ataki prompt injection?

Ataki typu prompt injection polegają na przemycaniu do analizowanych treści specjalnie przygotowanych instrukcji, które mogą wpłynąć na zachowanie modelu AI. Przykładowo chatbot analizujący stronę internetową lub dokument może natrafić na ukryty tekst nakazujący mu ignorowanie wcześniejszych poleceń lub ujawnienie określonych informacji.

Choć współczesne modele AI są coraz lepiej zabezpieczone przed takimi próbami manipulacji, eksperci od bezpieczeństwa od dawna wskazują prompt injection jako jedno z najważniejszych zagrożeń dla systemów opartych na dużych modelach językowych.

Co wyłącza Lockdown Mode?

Aby ograniczyć powierzchnię potencjalnego ataku, Lockdown Mode dezaktywuje kilka zaawansowanych funkcji ChatGPT. Po jego włączeniu użytkownicy nie będą mogli korzystać między innymi z:

  • przeglądania internetu w czasie rzeczywistym,
  • pobierania i wyświetlania obrazów z sieci,
  • funkcji Deep Research,
  • trybu Agent Mode.

W praktyce oznacza to, że ChatGPT będzie działał w bardziej zamkniętym środowisku. A także korzystał wyłącznie z wcześniej zapisanych lub dostarczonych danych. Nadal możliwe pozostanie jednak generowanie obrazów przy użyciu modeli OpenAI.

Ochrona nie jest stuprocentowa

Sama firma podkreśla, że Lockdown Mode nie eliminuje całkowicie zagrożenia. Złośliwe instrukcje mogą bowiem znajdować się również w pamięci podręcznej przeglądanych wcześniej treści lub w plikach przesyłanych przez użytkownika.

OpenAI zaznacza, że nawet po aktywowaniu nowego trybu prompt injection może wpływać na zachowanie modelu lub dokładność odpowiedzi. Celem rozwiązania jest jednak znaczące zmniejszenie prawdopodobieństwa nieautoryzowanego ujawnienia wrażliwych informacji.

Odpowiedź na rosnące obawy związane z AI

Pojawienie się Lockdown Mode pokazuje, że bezpieczeństwo staje się jednym z kluczowych obszarów rozwoju generatywnej sztucznej inteligencji. Wraz z rosnącą popularnością agentów AI zdolnych do samodzielnego przeglądania internetu, analizowania dokumentów i wykonywania złożonych zadań, zagrożenia związane z manipulacją danymi stają się coraz bardziej realne.

Nowa funkcja może okazać się szczególnie przydatna dla firm, kancelarii prawnych, instytucji finansowych czy zespołów badawczych, które przetwarzają poufne informacje i chcą ograniczyć ryzyko ich przypadkowego ujawnienia.

Kto otrzyma nową funkcję?

OpenAI poinformowało, że rozpoczęło już wdrażanie Lockdown Mode dla użytkowników korzystających z planów ChatGPT Business w modelu self-service. Funkcja trafia również do wybranych kont indywidualnych spełniających określone kryteria.

Nie podano jeszcze dokładnego harmonogramu globalnego udostępnienia nowego trybu wszystkim użytkownikom platformy.

Foto: DepositPhotos.

Podziel się artykułem

PortalTechnologiczny.pl

Wykorzystujemy ciasteczka do spersonalizowania treści i reklam, aby oferować funkcje społecznościowe i analizować ruch w naszej witrynie.

Informacje o tym, jak korzystasz z naszej witryny, udostępniamy partnerom społecznościowym, reklamowym i analitycznym. Partnerzy mogą połączyć te informacje z innymi danymi otrzymanymi od Ciebie lub uzyskanymi podczas korzystania z ich usług.

Informacja o tym, w jaki sposób Google przetwarza dane, znajdują się tutaj.