Gemini 4 Argon od Google to nowy model do kodowania i cyberbezpieczeństwa z limitem 1 mln tokenów, lepszy w testach niż GPT-6 Astra i Claude Opus 5.5.

Źródło zdjęcia: Spider's Web
Google ogłosiło premierę Gemini 4 Argon, modelu, który firma opisuje jako najpotężniejszy w swojej historii. Nowa architektura powstała od zera i zrywa z serią Gemini 3.x, która w ostatnich miesiącach ustępowała konkurencji.
Wcześniejsze wersje Gemini – 3.5 i 3.8 – trafiły do użytkowników wyłącznie w lżejszym wariancie Flash. Inżynierowie Google zdecydowali się wtedy skasować bardziej ambitny projekt Gemini 3.5 Pro, stawiając na obniżanie kosztów utrzymania serwerów. Prace nad mocniejszą linią Pro zostały zamrożone, a osoby liczące na skok jakościowy musiały korzystać z szybszych, ale prostszych modeli. Ostatnim zaprezentowanym modelem z tej serii pozostał Gemini 3.1 Pro, który z czasem zaczął przegrywać z konkurencją.
Google uznało, że dalsze łatanie starszej technologii nie ma sensu i pominęło planowany etap rozwoju, budując zupełnie nową architekturę. Tak powstał Gemini 4 Argon – model zaprojektowany z myślą o programowaniu, pisaniu, analizie danych oraz, jak podkreśla TechCrunch, pracy defensywnej w cyberbezpieczeństwie.
Google chwali się, że Argon potrafi samodzielnie wyszukiwać błędy w kodzie, sprawdzać je i automatycznie naprawiać. W swoim wpisie blogowym firma opisała model jako „zbudowany, by podtrzymywać głębokie rozumowanie w złożonych, długofalowych procesach pracy”, co „fundamentalnie zmienia sposób, w jaki pracujemy i budujemy w Google”.
Na początku model udostępniono wybranym partnerom oraz wewnętrznym zespołom firmy. Według TechCrunch, Argon trafia do selektywnej grupy partnerów cybernetycznych poprzez program Fairwind – inicjatywę bezpieczeństwa Google. Pracownicy firmy już korzystają z modelu w codziennej pracy, m.in. do debugowania i migracji baz kodu, a Argon dobrze radzi sobie też z analizą treści wizualnych – długich nagrań wideo czy wykresów.
Jednym z konkretnych zastosowań wewnętrznych było przepisywanie starych programów z języków C i C++ na bezpieczniejszy Rust. Model analizuje całe zestawy plików i generuje kod, który w testach działa szybciej niż przy standardowych, automatycznych konwersjach. Innym efektem prac Argona jest zwolnienie ponad 300 TiB miejsca w centrach danych Google dzięki optymalizacji pamięci.
W testach porównawczych przygotowanych przez samego Google Argon osiąga lepsze wyniki niż konkurencyjne modele – Claude Opus 5.5 i Fable od Anthropic oraz GPT-6 Astra od OpenAI. Firma odwołuje się też do rankingu Vals, coraz popularniejszego startupu zajmującego się benchmarkowaniem modeli AI, gdzie Argon ma zajmować pozycję liderową. Warto pamiętać, że laboratoria AI regularnie ogłaszają swoje najnowsze modele jako przełomowe – podobną retoryką OpenAI opisywało niedawno model Astra, a Anthropic model Fable.
Przed udostępnieniem modelu Google wprowadziło rygorystyczne mechanizmy kontrolne. Argon ma chronić przed wykorzystaniem do groźnych celów – takich jak ataki cybernetyczne czy chemiczne – oraz przed próbami oszukania go za pomocą złośliwych poleceń. Specjalne systemy śledzą proces myślowy modelu w czasie rzeczywistym: jeśli Argon spróbuje obejść zasady, jego odpowiedź zostaje natychmiast zatrzymana, a informacje o takiej próbie nie trafiają do ponownego treningu – ma to zapobiegać sytuacji, w której model nauczyłby się lepiej ukrywać podobne działania w przyszłości. To podejście wpisuje się w szerszy trend wzmożonej kontroli nad procesem rozumowania modeli, widoczny też u innych laboratoriów AI.
Gemini 4 Argon będzie dostępny w płatnej subskrypcji Google AI Ultra oraz w interfejsie API dla firm i programistów. Opłaty startowe wynoszą 2 dolary za milion tokenów wejściowych i 10 dolarów za milion tokenów wyjściowych, z dużym rabatem na zapamiętany kontekst – po okresie promocyjnym ceny mają wzrosnąć. To wyraźny sygnał, że model jest skierowany głównie do zastosowań profesjonalnych, nie do masowego, darmowego użytkownika.
Dla osób korzystających z bezpłatnej wersji Gemini premiera Argona na razie nic nie zmienia – do codziennych zadań, jak pisanie e-maili czy streszczanie tekstów, wciąż będą służyć tańsze i szybsze modele z serii Flash. Pełna moc Argona jest zarezerwowana dla klientów biznesowych i użytkowników pakietu Ultra, którzy zyskują bardzo wysoki limit odpowiedzi – sztuczna inteligencja nie przerywa generowania tekstu w połowie, co pozwala analizować za jednym razem całe projekty, długie nagrania wideo czy kompleksowe raporty. Pozostali użytkownicy mogą odczuć efekty pośrednio, w postaci stabilniejszych i bezpieczniejszych aplikacji – przepisywanie kluczowych usług na bezpieczniejszy język programowania oraz automatyczne naprawianie błędów ma zmniejszać ryzyko awarii i ataków hakerskich na telefonach czy w przeglądarce.
TechCrunch zwraca też uwagę na szerszy kontekst rynkowy: Google, jeszcze niedawno uznawane za „zapóźnione” w wyścigu AI, ogłosiło w sierpniu, że jego aplikacja ma ponad miliard użytkowników miesięcznie – liczbę porównywalną z ChatGPT od OpenAI, który niedawno ogłosił osiągnięcie podobnego pułapu.
Gemini 4 Argon to zupełnie nowa architektura Google, stawiająca na programowanie, cyberbezpieczeństwo i ogromny limit generowanego tekstu – sięgający miliona tokenów. Na razie trafia głównie do partnerów biznesowych i płatnych użytkowników Ultra, a zwykli użytkownicy darmowego Gemini odczują jej efekty najwcześniej pośrednio, w postaci bezpieczniejszych i stabilniejszych aplikacji.

Rzeczniczka OpenAI przerwała wywiad Vanity Fair z Samem Altmanem, gdy dziennikarz zapytał o samobójstwo użytkowniczki ChatGPT.

Nowa metoda MintFlow wymusza ograniczenia na próbkach flow matching, minimalnie zaburzając trajektorię i zachowując pretrenowany rozkład danych.

Framework ADSD łączy diagnozę błędów z reużywalnymi umiejętnościami solvera, redukując błąd o niemal 71 razy w testach przepływu mocy.