146 artykułów z tym tagiem
Rząd amerykański zniósł blokadę zaawansowanego modelu AI Anthropic, umożliwiając dostęp ponad 100 instytucjom po dwóch tygodniach negocjacji.
Rząd USA złagodził ograniczenia na Claude Mythos 5, pozwalając na dostęp ponad 100 amerykańskim organizacjom. Claude Fable 5 nadal zablokowany.
Inicjatywa Akrites ma łatać luki bezpieczeństwa w oprogramowaniu open-source, zanim AI będzie mogło je wykorzystać do ataków. Mniej niż 5% luk zostało załatanych.
Twórca Claude ostrzega przed zagrożeniami AI, jednocześnie rozwijając najnowocześniejsze modele. Strategia firmy: być liderem, aby wpływać na bezpieczeństwo.
Eksperyment hackmyclaw.com pokazał, że nawet 6000 wyrafinowanych ataków prompt injection nie było w stanie złamać zabezpieczeń Claude Opus 4.6.
Naukowcy stworzyli RIFT-Bench — pierwszy zunifikowany framework do oceny bezpieczeństwa różnorodnych systemów agentowych AI w dynamicznym red-teamingu.
Biały Dom zablokował modele AI Anthropic, ale historia pokazuje, że kontrola eksportu technologii od szyfrowania po spyware rzadko osiąga zamierzone cele.
Rząd USA zmusił Anthropic do wycofania modeli Fable 5 i Mythos 5. Eksperci kwestionują uzasadnienie, sugerując że zakaz może wzmocnić pozycję firmy.
Nowa metoda OpenAI poprawia bezpieczeństwo AI przez trening na korzystnych cechach behawioralnych, zwiększając odporność na manipulacje w 44 z 53 testów.
Spór Antropic z administracją Trumpa ujawnia chaotyczną naturę amerykańskich regulacji AI, gdzie decyzje podejmowane są bez jasnych zasad.
AgenticRei to pierwszy system realizujący kompleksowe wymagania zarządzania agentami AI, w tym zobowiązania i rozwiązywanie konfliktów polityk.
Administracja Trumpa blokuje model Claude Fable 5 do czasu wyeliminowania jailbreakingu. Eksperci twierdzą, że może to być niemożliwe.