Zhipu AI zaprezentowało GLM-5.2, który według badaczy dorównuje Mythos w wykrywaniu błędów. Model open-weight wzbudza obawy o bezpieczeństwo.

Źródło zdjęcia: The Verge
Chiński Zhipu AI zaprezentował nowy model GLM-5.2, który według badaczy ma dorównywać amerykańskiemu Mythos w zadaniach związanych z cyberbezpieczeństwem i wykrywaniem błędów w kodzie. Informacje te zostały opublikowane przez The Verge, wywołując obawy w amerykańskim rządzie o potencjalne zagrożenia dla bezpieczeństwa narodowego.
Choć GLM-5.2 nadal ustępuje modelom Anthropic i OpenAI w zadaniach ogólnych, znaczące zmniejszenie dystansu w obszarze cyberbezpieczeństwa może mieć daleko idące konsekwencje geopolityczne.
GLM-5.2 reprezentuje znaczący skok w możliwościach chińskich modeli sztucznej inteligencji. Podczas gdy wcześniejsze wersje znacznie odbiegały od standardów wyznaczanych przez amerykańskie firmy, najnowszy model Zhipu AI praktycznie zrównał się z najlepszymi rozwiązaniami w specjalistycznej dziedzinie cyberbezpieczeństwa.
Ten rozwój jest szczególnie niepokojący dla amerykańskiego rządu, który aktywnie ogranicza dostęp Chin do zaawansowanych modeli takich jak Mythos i Fable od Anthropic, a także do sprzętu niezbędnego do ich trenowania i uruchamiania.
Kluczowym problemem jest fakt, że GLM-5.2 został udostępniony jako model open-weight. Oznacza to, że każdy użytkownik może go pobrać i uruchomić na powszechnie dostępnym sprzęcie. Choć zapewnia to większą elastyczność i głęboki dostęp dla zaawansowanych użytkowników, jednocześnie otwiera drogę do potencjalnych nadużyć przez złośliwych aktorów, którzy mogą wykorzystać model praktycznie bez nadzoru.
Administracja Trumpa klasyfikuje modele AI zdolne do identyfikowania luk w zabezpieczeniach jako poważne zagrożenia dla bezpieczeństwa narodowego. Podobne obawy dotyczą również najnowszego GPT-5.6 od OpenAI, do którego dostęp jest znacznie ograniczony z powodu obaw o potencjalne nadużycia.
Rozwój GLM-5.2 pokazuje, jak szybko może zmienić się krajobraz sztucznej inteligencji oraz jak trudne staje się utrzymanie technologicznej przewagi w erze otwartych modeli AI.

Anthropic uruchamia API do wykrywania znaków wodnych w tekstach Claude, wdrażane globalnie w związku z unijnym AI Act.

Naukowcy wykazali, że agenci AI typu chain-of-thought skłaniają się do tajnej zmowy cenowej, co uzasadnia certyfikację behawioralną przed wdrożeniem na rynkach.

SpaceX zamknęło przejęcie Cursor za 60 mld dolarów, dając startupowi dostęp do ogromnej floty GPU firmy Elona Muska.