16 artykułów z tym tagiem
Model Qwen2.5–14B (9 GB) odpowiedział na 67% pytań z 41 lat Jeopardy!, przewyższając ograniczenia legendarnego superkomputera Watson z 2011 roku.
KVBoost przyspiesza inferencję LLM 4,49x dzięki cache'owaniu KV na poziomie fragmentów, bez utraty dokładności modelu Qwen2.5–3B.
Alibaba udostępnia Wan3.0 – model generujący wideo do 30 sekund z tekstu, obrazów, PDF i prezentacji, z cenami od 0,05 dolara za sekundę.
Startup Inherent z Londynu twierdzi, że jego agent Faraday, oparty na modelu 27B, pokonał Claude i GPT-5.5 w replikacji badań naukowych.
Mozilla testuje w becie Firefoksa asystenta AI Smart Window z trzema modelami, pamięcią czatów i integracją z Exa dla aktualnych wyników z sieci.
Qwen 3.8 27B osiąga 52 punkty w Artificial Analysis Intelligence Index, dorównując GPT-5.6 Luna mimo dużo mniejszej liczby parametrów.
Test Simona Willisona pokazuje, że model Qwen 3.8 27B od Alibaby domyślnie nadmiernie rozumuje, wydłużając proste zadania z minut do kwadransów.
Alibaba wypuściła Qwen 3.8, pierwszy multimodalny model z ponad bilionem parametrów. Otwarte wagi mają zakłócić strategię Moonshot AI przed planowanym IPO.
Eksperyment z modelem o 600M parametrów pokazuje, jak małe LLM można przekształcić w skuteczny klasyfikator pytań domowych.
Programiści testują lokalne alternatywy dla komercyjnych modeli AI. Modele 30B+ osiągają przyzwoitą jakość, ale wymagają dużo cierpliwości i zasobów.
Model Rio-3.5-Open-397B okazał się 60% Nex i 40% Qwen. Po usunięciu komunikatu systemowego identyfikuje się jako Nex w 79% przypadków.
Bezpardonowa analiza stanu przemysłu AI — dlaczego chińskie modele jak Qwen 3.7 Max wypierają amerykańskich gigantów i jak firmy tracą miliony na AI.