OpenAI uruchomiło Lockdown Mode dla ChatGPT — nową funkcję zabezpieczającą wrażliwe dane przed atakami prompt injection w firmach i organizacjach.

Źródło zdjęcia: TechCrunch
OpenAI wprowadza nową funkcję Lockdown Mode, która ma zapewnić dodatkową ochronę przed atakami prompt injection, w których złośliwe instrukcje dla chatbota są ukryte na stronach internetowych i w innych źródłach treści. Nowa funkcja została zaprojektowana specjalnie dla osób i organizacji obsługujących wrażliwe dane. Więcej szczegółów w oryginalnym artykule na TechCrunch.
Nowa funkcja wprowadza szereg ograniczeń mających na celu zmniejszenie ryzyka wycieku wrażliwych danych. W trybie Lockdown ChatGPT nie może przeglądać internetu w czasie rzeczywistym — użytkownicy mają dostęp jedynie do treści cache'owanych. System wyłącza również możliwość pobierania i wyświetlania obrazów z sieci, choć zachowuje funkcję generowania własnych obrazów.
Dodatkowo tryb bezpieczeństwa dezaktywuje zaawansowane funkcje jak deep research i tryb agenta, które mogłyby potencjalnie zwiększać powierzchnię ataku dla złośliwych instrukcji.
OpenAI jasno komunikuje, że Lockdown Mode nie jest rozwiązaniem uniwersalnym. Jak przyznaje firma, ”nawet z włączonym trybem Lockdown ChatGPT może pozostać podatny na ataki prompt injection”. Złośliwe instrukcje mogą nadal ”pojawiać się w cache'owanych treściach internetowych lub przesłanych plikach i wciąż wpływać na zachowanie lub dokładność odpowiedzi”.
Celem nowej funkcji nie jest całkowite wyeliminowanie zagrożeń, ale ”zmniejszenie prawdopodobieństwa udostępnienia wrażliwych danych w tym procesie”. OpenAI podkreśla, że ”Lockdown Mode nie jest przeznaczony dla wszystkich” — funkcja została zaprojektowana dla ”osób i organizacji obsługujących wrażliwe dane i chcących ściślejszej ochrony przed ryzykiem eksfiltracji danych związanym z prompt injection”.
Lockdown Mode stanowi pierwszy krok OpenAI w kierunku lepszego zabezpieczenia ChatGPT przed rosnącymi zagrożeniami związanymi z atakami prompt injection, choć firma realistycznie ocenia jego możliwości jako rozwiązania pomocniczego, a nie kompletnego.

OpenAI wprowadza Codex Micro — panel za 230 dolarów do zarządzania agentami AI. Urządzenie oferuje dwukierunkową komunikację i bezpośredni dostęp do API.

Nowy benchmark RadLE 2.0 pokazuje, że modele AI w radiologii często wydają błędne diagnozy z pełną pewnością siebie, co stanowi zagrożenie dla pacjentów.

Patreon współpracuje z Cloudflare, by aktywnie blokować boty AI. Liczba prób dostępu spadła z tysięcy do zera po wprowadzeniu nowych zabezpieczeń.