Chińska firma Deepseek wypuściła model V4 Flash, który osiąga niemal identyczne wyniki jak flagowy GPT-5.6 Luna od OpenAI, kosztując znacząco mniej.

Źródło zdjęcia: The Decoder
Chińska firma Deepseek wypuściła nową wersję swojego budżetowego modelu AI — V4 Flash „0731”, który osiąga wyniki niemal dorównujące flagowemu GPT-5.6 Luna od OpenAI, kosztując jednocześnie około 60% mniej. Według Artificial Analysis Intelligence Index, nowa wersja modelu zdobyła 50 punktów, co oznacza wzrost o 10 punktów w porównaniu z poprzednią wersją z kwietnia 2026 roku.
To stawia Deepseek V4 Flash zaledwie jeden punkt za OpenAI GPT-5.6 Luna, mimo że koszt użycia jest znacząco niższy nawet po 80-procentowej obniżce cen wprowadzonej przez OpenAI.
Nowa wersja Deepseek V4 Flash wykazuje poprawę we wszystkich testowanych kategoriach w porównaniu z poprzednią wersją. Szczególnie imponujący jest postęp w zadaniach agentycznych — w benchmarku GDPval, który testuje modele w złożonych rzeczywistych zadaniach biurowych, model skoczył z 1,189 do 1,559 punktów Elo.
Model również rzadziej halucynuje, co oznacza większą wiarygodność generowanych odpowiedzi. To kluczowe ulepszenie dla zastosowań biznesowych, gdzie dokładność informacji ma pierwszorzędne znaczenie.
Głównym atutem nowego modelu Deepseek pozostaje jego konkurencyjna cena. Firma oferuje 98-procentową zniżkę za wykorzystanie cache, co znacznie przewyższa branżowy standard wynoszący 90%. Dodatkowo model zużywa o 12% mniej tokenów niż jego poprzednik, co przekłada się na dalsze oszczędności dla użytkowników.
Ta kombinacja czynników sprawia, że Deepseek V4 Flash „0731” zajmuje pierwszą pozycję pod względem stosunku ceny do wydajności, mimo że OpenAI obniżyło ceny swojego modelu GPT-5.6 Luna o 80%.
Deepseek V4 Flash „0731” potwierdza trend demokratyzacji zaawansowanej sztucznej inteligencji, oferując wydajność na poziomie flagowych modeli przy znacznie niższych kosztach. To może przyspieszyć adopcję AI w mniejszych firmach i projektach z ograniczonym budżetem.

Nowa metoda Google Cloud AI Research, RRSI, ogranicza przeuczanie agentów AI na testach i poprawia wyniki na nieznanych zadaniach przy niższych kosztach.

David Robinson rzuca pracę w OpenAI, oceniając, że kultura firmy jest „zepsuta”, a branża AI nie jest wystarczająco ostrożna wobec zagrożeń.

Sam Altman mówi, że przypisywanie AI religijnej siły to zagrożenie bezpieczeństwa – zmiana tonu wobec jego wcześniejszych deklaracji o „magicznej inteligencji na niebie”.