26 artykułów z tym tagiem
Chiński gigant Alibaba prezentuje model Qwen3.8-Max z 2,4 biliona parametrów, który według testów dorównuje najlepszym amerykańskim systemom AI.
Nowy model Opus 5 od Anthropic przewyższa większy Fable 5 w testach, oferując mniej ograniczeń i lepszą dostępność dla użytkowników.
Kimi K3 osiągnął tylko 32% skuteczności w testach cybernetycznych, podczas gdy amerykańskie modele uzyskały 76%. Destylacja może tłumaczyć te różnice.
Google DeepMind przedstawił Gemini 3.6 Flash, 3.5 Flash-Lite i 3.5 Flash Cyber, ale flagowy model Pro nadal czeka na aktualizację od lutego.
Arthur Mensch z Mistral twierdzi, że laboratoria AI wykorzystują dane klientów przeciw najbardziej udanym firmom. Zaleca własne modele open-source.
Sakana AI i firma 360 wprowadzają modele Fugu i Tulongfeng jako odpowiedź na zakaz eksportu zaawansowanych rozwiązań Anthropic przez administrację Trumpa.
Decyzja Anthropic o zawieszeniu dostępu do modeli Fable 5 i Mythos 5 wywołała debatę w Indiach o niezależności technologicznej i rozwoju krajowych rozwiązań AI.
Nowy model AI ma umożliwić firmom strategiczne planowanie i realizację celów bez ludzkiej interwencji, wykraczając poza automatyzację zadań.
ITBench-AA pokazuje, że nawet Claude Opus 4.7 i GPT-5.5 nie przekraczają 50% w zadaniach Site Reliability Engineering. Pierwszy benchmark agentów IT.
SOOHAK odsłania słabości AI: najlepszy model osiągnął 30% w trudnych zadaniach i nie potrafi odmówić odpowiedzi na problemy bez rozwiązania.
Anthropic udostępniła przewodnik konfiguracji modeli Claude Code. Trzy metody przełączania między sześcioma modelami — od komendy /model po zmienne środowiskowe.
OpenAI po raz drugi eliminuje osobny model programistyczny Codex, integrując go z GPT-5.5. Wersja 5.3 była ostatnim samodzielnym Codex.