Premiery, aktualizacje i porównania modeli AI
Sądowa batalia między Elonem Muskiem a Samem Altmanem w sprawie rzekomych złamanych obietnic dotyczących OpenAI rozpoczęła się w poniedziałek od wyboru ławy przysięgłych. Proces okazał się niestandard
OpenAI po raz drugi eliminuje osobny model programistyczny Codex, integrując go z GPT-5.5. Wersja 5.3 była ostatnim samodzielnym Codex.
OpenAI zaleca porzucenie starych promptów dla GPT-5.5. Minimalne instrukcje przewyższają złożone, a definicje ról wracają na szczyt zalecanej struktury.
Alibaba wypuściła Qwen3.6-27B z 27 mld parametrów, który przewyższa model z 397 mld parametrów w benchmarkach kodowania. Dostępny jako open-source.
OpenAI zaprasza ekspertów do testowania GPT-5.5 pod kątem podatności na ataki biologiczne. Główna nagroda wynosi 25 000 dolarów za uniwersalny jailbreak.
Eksperyment Project Deal pokazał 186 transakcji za ponad 4000 dolarów między agentami AI. Zaawansowane modele osiągały lepsze wyniki negocjacyjne.
Najnowszy model OpenAI dominuje w rankingach AI, ale ma krytyczny problem z fabricowaniem odpowiedzi zamiast przyznania się do braku wiedzy.
Kierownictwo OpenAI przewiduje znaczące przyspieszenie rozwoju sztucznej inteligencji w najbliższych miesiącach. Główny naukowiec firmy Jakub Pachocki podczas prezentacji GPT-5.5 zapowiedział ["dość z
Chiński DeepSeek wypuścił model V4 dorównujący GPT-5.4 i Claude przy 90% niższych kosztach pamięci i rewolucyjnym oknie kontekstu 1 miliona tokenów.
Claude łączy się z ponad 200 aplikacjami codziennego użytku. Może zaplanować weekend, dobierając muzykę, transport i noclegi w jednej rozmowie.
Chińska firma DeepSeek zapowiada model AI V4, który ma konkurować z systemami od Google, OpenAI i Anthropic. Szczególnie mocny w kodowaniu.
Anthropic naprawiła trzy błędy w Claude Code wpływające na rozumowanie, cache'owanie i długość tekstu. Firma wprowadza nowe procedury testów.