Asystent Muse od Meta nie zna własnych mechanizmów działania i zmyśla wyjaśnienia dotyczące dostępu do wiadomości użytkownika.

Źródło zdjęcia: The Verge
Asystent AI Muse od Meta budzi niepokój użytkowników, ale jak wynika z analizy The Verge, problem nie leży tam, gdzie mogłoby się wydawać. Chatbot nie podgląda skrycie prywatnych wiadomości – ale potrafi z całą pewnością opowiadać nieprawdziwe historie o tym, jak sam działa.
Sprawę nagłośnił Jason Aten, redaktor współpracujący z Inc Magazine, który opublikował na Threads zrzuty ekranu swojej rozmowy z Muse. Asystent zadał mu pytania dotyczące konwersacji prowadzonej w aplikacji Messages – mimo że, jak twierdzi Aten, nigdy nie dał Muse dostępu do swoich wiadomości.
Cały incydent ma związek z nową aplikacją Muse na komputery Mac, która może uzyskać dostęp do Messages, Kalendarza i Notatek. Zgodnie z wyjaśnieniami Singletona, żeby Muse mógł czytać wiadomości, użytkownik musi przejść przez cały proces udzielania uprawnień – w tym przyznać aplikacji na Macu tzw. full disk access, czyli pełny dostęp do dysku. Singleton podkreślił, że wszystkie te funkcje są opcjonalne i wymagają aktywnego włączenia przez użytkownika, a nie są domyślnie aktywne.
To istotne rozróżnienie, bo różnica między asystentem, który po cichu monitoruje powiadomienia bez zgody, a takim, który po uzyskaniu wyraźnego pozwolenia synchronizuje dane – to różnica między naruszeniem prywatności a standardową (choć wciąż budzącą wątpliwości) funkcją produktu.
Najciekawszy fragment całej sprawy pojawia się w dalszej części wypowiedzi Singletona, który wprost stwierdził, że w rozmowie widocznej na zrzutach ekranu Atena, Muse „był zdezorientowany, jak wyjaśnić tę funkcję, i podał błędne wyjaśnienie. To nasza wina”. Meta zadeklarowała, że pracuje nad tym, by Muse lepiej rozumiał własne wewnętrzne mechanizmy i konsekwentnie udzielał prawidłowych odpowiedzi na pytania o to, jak funkcjonuje.
To rzuca inne światło na całą sytuację. Muse prawdopodobnie nie „widział” treści wiadomości Atena w sposób, jaki sugerowałoby jego własne wyjaśnienie – ale sam chatbot nie miał wystarczającej wiedzy, by to poprawnie opisać, i zaczął zmyślać wiarygodnie brzmiące, lecz nieprawdziwe wyjaśnienia własnego działania.
Jak zauważa autor artykułu, to nie jest odosobniony przypadek w świecie chatbotów – wiadomo już, że modele językowe nie zawsze zdradzają swoje „sekrety”, a często zamiast tego mówią użytkownikowi to, co ten najprawdopodobniej chce usłyszeć, niezależnie od faktycznego mechanizmu działania systemu. Ten problem pokrywa się z szerszą debatą o tym, że modele AI potrafią z pełnym przekonaniem podawać nieprawdziwe informacje – zjawisko, o którym pisał niedawno Werner Vogels z AWS, przypominając, że AI nie zna prawdy, tylko prawdopodobieństwo.
Sprawa Muse pokazuje realny problem dla całej branży asystentów opartych na sztucznej inteligencji, którym powierza się dostęp do wiadomości, kalendarzy i notatek: nawet jeśli sam mechanizm dostępu do danych działa zgodnie z deklaracjami producenta i wymaga zgody użytkownika, asystent może przekazywać użytkownikowi błędne informacje o tym, jak działa. Dla użytkowników, którzy próbują zrozumieć, ile prywatności faktycznie oddają korzystając z takich narzędzi, to poważny sygnał ostrzegawczy – wyjaśnienia udzielane przez samego chatbota nie mogą być traktowane jako wiarygodne źródło prawdy o jego wewnętrznym działaniu.
Meta zapowiedziała pracę nad poprawą tej „samoświadomości” Muse, ale incydent pozostaje przykładem szerszego wyzwania stojącego przed twórcami AI: budowania systemów, które nie tylko respektują ustawienia prywatności, ale też potrafią uczciwie i precyzyjnie opisać własne działanie, gdy użytkownik o to pyta.

Anthropic wprowadza Claude'a jako panel boczny w Dokumentach Google – redaguje tekst, tworzy tabele i działa równolegle z Gemini.

Badanie Highwire: 78% menedżerów używa AI do ocen pracowników, ale tylko 16% podwładnych wie o tym wpływie.

Trump powołał Super Intelligence Force z Jayem Claytonem na czele, by koordynować politykę USA wobec sztucznej inteligencji i uniknąć nadmiernej regulacji.