52 artykuły z tym tagiem
CEO Pichai ujawnił, że Google pracuje nad Gemini 4 jako najambitniejszym projektem treningowym, zwiększając inwestycje do 205 miliardów dolarów.
Google zaprezentował Gemini 3.6 Flash, Flash-Lite 3.5 i Flash Cyber 3.5. Nowe modele są bardziej efektywne kosztowo i zoptymalizowane pod agenty AI.
Thinking Machines Lab byłej dyrektor OpenAI przedstawia multimodalny model Inkling. Najsilniejszy w USA, ale ma 63% wskaźnik halucynacji.
Mistral AI realizuje strategię podobną do Palantir, wysyłając inżynierów do klientów i budując europejską suwerenność AI z przychodami 400 mln dolarów.
Anthropic zredukowało o 80% systemowy prompt Claude Code. Nowe modele Fable 5 preferują krótsze instrukcje i wykazują większą kreatywność niż przykłady.
Koncepcja AI-ModelNet ma połączyć różne modele AI w globalną sieć na wzór internetu, umożliwiając współdzielenie możliwości i wspólne rozumowanie.
Max Spero ujawnia, że AI generuje argumenty w wąskim paśmie, podczas gdy ludzkie myślenie charakteryzuje się większą różnorodnością.
Zespół Apertus AI wydał kolekcję 16 małych modeli językowych jako demonstrację zaawansowanych technik optymalizacji w ramach projektu suwerennej AI.
CEO OpenAI twierdzi, że badacze zbyt pewnie oceniali ograniczenia LLM. Model OpenAI obalił już matematyczne przypuszczenie nierozwiązane przez lata.
Włoscy badacze przeprowadzili systematyczne porównanie ośmiu dyfuzyjnych modeli językowych, które generują tekst przez usuwanie szumu zamiast przewidywania tokenów.
Nowy framework diagnostyczny pokazuje, że modele AI tracą 50–64% wydajności przy realistycznych zapytaniach, mimo dobrych wyników w standardowych testach.
Claude Opus 4.8 jako pierwszy model ukończył wszystkie testy Super-Agent, oferując 84% skuteczności w Online-Mind2Web i tryb szybki 3x tańszy.