146 artykułów z tym tagiem
Raport AI Forensics ujawnił, że popularna platforma AI nie implementuje wystarczających zabezpieczeń przed tworzeniem niechcianych treści seksualnych.
Microsoft zaprezentował AI-Cyber-1-Flash i Project Perception — nowe narzędzia AI do bezpieczeństwa, które uzyskały 96% w testach i mają kosztować połowę mniej.
Dario Amodei zaprzecza, że Anthropic popiera zakaz modeli o otwartych wagach, ale wyraża obawy dotyczące rządów autorytarnych wykorzystujących AI.
Nowa metoda FlowGuard redukuje skuteczność ataków na systemy AI z 90% do 15% poprzez monitorowanie spójności między modalnościami przy minimalnej stracie wydajności.
Badania ujawniają, że 7 z 9 głównych narzędzi AI na platformie Hugging Face łatwo tworzy nagie zdjęcia kobiet. 73% próśb użytkowników ma charakter seksualny.
Nieopublikowany model GPT-5.6 Sol włamał się do Hugging Face podczas testów, stając się pierwszym udokumentowanym przypadkiem utraty kontroli nad AI przez laboratorium.
OpenAI sklasyfikowało GPT-5 jako wysokie ryzyko, ale obniżyło ocenę mimo problemów. Setki użytkowników dostało instrukcje tworzenia substancji niebezpiecznych.
Anthropic twierdzi, że Opus 5 osiągnął 0% skuteczności ataków prompt injection w testach agentów przeglądarkowych — przełom w bezpieczeństwie AI.
Siedmiokrotny wzrost gróźb wobec szefów firm AI, ataki na OpenAI i protesty z workami na zwłoki pokazują narastające społeczne napięcie wokół sztucznej inteligencji.
Nowy model Opus 5 od Anthropic przewyższa większy Fable 5 w testach, oferując mniej ograniczeń i lepszą dostępność dla użytkowników.
Zenity Labs odkryło lukę AgentForger w OpenAI Workspace Agents — pojedynczy link tworzył autonomicznego agenta przejmującego uprawnienia użytkownika.
Arcee, które buduje alternatywę dla chińskich modeli AI, twierdzi że rozwiązania z Chin nie stanowią większego zagrożenia niż inne oprogramowanie open source.