Premiery, aktualizacje i porównania modeli AI
Rząd USA zezwolił wybranym organizacjom na korzystanie z Mythos 5, ale publiczny model Fable 5 nadal pozostaje zablokowany bez jasnego harmonogramu.
Ponad 100 amerykańskich firm i agencji otrzymało dostęp do modelu cyberbezpieczeństwa Anthropic dwa tygodnie po wprowadzeniu zakazu.
OpenAI wypuściło GPT-5.6 w wersjach Sol, Terra i Luna zaledwie dzień po żądaniu opóźnienia przez administrację Trumpa. Nowe modele kosztują mniej niż konkurencja.
OpenAI musi najpierw udostępnić nowe modele AI wybranym klientom zatwierdzonym przez rząd amerykański, zanim będą dostępne publicznie.
Benchmark MirrorCode testuje zdolność modeli AI do odtwarzania programów od podstaw. Claude Opus 4.7 prowadzi z 56% skutecznością.
GPT-5.5 Instant w ChatGPT otrzymał aktualizację poprawiającą zrozumienie celów użytkowników i jakość odpowiedzi w lokalnych zapytaniach biznesowych.
Gemini 3.5 Flash otrzymał wbudowaną funkcję computer use, umożliwiając tworzenie agentów AI zdolnych do interakcji z różnymi platformami i aplikacjami.
Test programistyczny pokazał zbliżoną skuteczność GLM-5.2 i Opus 4.7, ale dramatyczna różnica w cenie może wywrócić rynek AI do góry nogami.
OpenAI zaprezentowało GPT-5.5-Cyber, który osiąga 85,6% w benchmarku CyberGym, przewyższając konkurencyjny Mythos 5. Nowy model automatyzuje proces od wykrycia luk do łatek.
Zespół Apertus AI wydał kolekcję 16 małych modeli językowych jako demonstrację zaawansowanych technik optymalizacji w ramach projektu suwerennej AI.
CEO OpenAI twierdzi, że badacze zbyt pewnie oceniali ograniczenia LLM. Model OpenAI obalił już matematyczne przypuszczenie nierozwiązane przez lata.
Przetestowaliśmy nową Siri AI z iOS 27. Asystent wykorzystuje Google Gemini, analizuje dane użytkownika i oferuje spersonalizowane odpowiedzi.