Deepseek wypuszcza mocniejszy model V4-Pro, otwiera kod agenta Harness i podnosi ceny API przed planowanym IPO.

Źródło zdjęcia: The Decoder
Deepseek udostępniło zaktualizowaną wersję modelu V4-Pro, otwarto-kodowe oprogramowanie agentowe Deepseek Harness oraz nowy cennik API z wyższymi stawkami. Firma jednym ruchem wyprowadziła swój flagowy produkt z fazy testów, oddała społeczności swoje wcześniej zastrzeżone narzędzie agentowe i podniosła ceny dostępu do API — działania podjęte na tle przygotowań do pierwszej oferty publicznej.
Endpoint deepseek-v4-pro teraz obsługuje build V4-Pro-0813. Nazwa modelu, liczba parametrów oraz milionowe okno kontekstowe pozostają niezmienione, a Deepseek zapewnia, że istniejące integracje będą działać bez żadnych modyfikacji. W aplikacji i na stronie internetowej model jest dostępny w „Trybie Eksperckim”. Nowością jest natywne wsparcie dla OpenAI Responses API z integracją Codex. Poziom wysiłku rozumowania można ustawić na trzy poziomy: „low”, „high” i „max” — Deepseek rekomenduje ustawienie środkowe do codziennej pracy agentowej.
Nowy build pokazuje duże zyski względem wersji przedpremierowej, jednak przewyższa Kimi K3 i Fable 5 jedynie w pojedynczych kategoriach. Deepseek nie opublikował jeszcze wag nowej wersji — na Hugging Face wciąż dostępna jest kwietniowa wersja przedpremierowa.
Aktualizacja stanowiła też odpowiedź na to, że mniejszy model V4 Flash zaczął doganiać flagowy produkt. Pod koniec lipca Deepseek wypuściło aktualizację 0731 dla V4 Flash, która praktycznie zrównała się z wersją przedpremierową Pro w Intelligence Index Artificial Analysis, kosztując przy tym zdecydowanie mniej.
Wraz z aktualizacją modelu, Deepseek Harness v0.1 wchodzi w fazę Developer Preview na licencji MIT. To otwarto-kodowe oprogramowanie agentowe jest przedstawiane jako alternatywa dla Codex OpenAI oraz Claude Code. Opiera się na nowo udostępnionym systemie wtyczek Cordis, w którym wszystkie funkcje — od narzędzi i sandboxów po sesje i interfejs użytkownika — są wymiennymi modułami. Ciągły dziennik sesji rejestruje każdy prompt, każde wywołanie narzędzia i każdy wynik. Uruchomienia można wznawiać, rozgałęziać i odtwarzać.
Tryb minimalny ogranicza się do shella i edytora plików — Deepseek używa tej konfiguracji do własnych testów benchmarkowych. Oprogramowanie startuje przez npx z lokalnym interfejsem webowym, choć firma ostrzega o możliwych problemach z kompatybilnością. Projektem kieruje Cui Tianyi, który przyszedł do Deepseek z firmy tradingowej Jane Street w marcu 2026 roku. Gdy zespół ogłosił nabór beta-testerów na początku sierpnia, w ciągu trzech dni zgłosiło się 712 projektów.
Nowe stawki wchodzą w życie 16 sierpnia o 16:00 UTC. Deepseek ogłosiło przejście na cennik peak/off-peak już pod koniec czerwca, ale bez konkretnych liczb i daty. Zróżnicowane w czasie stawki obowiązują od lutego 2025 roku, gdy firma zaczęła oferować zniżki na V3 i R1 w godzinach nocnych.
Użycie w godzinach poza szczytem kosztuje o połowę mniej. Szczyt przypada na godziny 1:00–4:00 i 6:00–10:00 UTC, co odpowiada chińskiemu dniowi pracy. Dla użytkowników w Europie oznacza to, że praktycznie całe popołudnie objęte jest niższą stawką.
Od 16 sierpnia Deepseek będzie stosować dwie stawki dla każdego modelu. W godzinach poza szczytem cena wejściowa V4-Pro wzrasta z 0,435 do 0,66 dolara za milion tokenów, a wyjściowa skacze z 0,87 do 1,98 dolara. W godzinach szczytu stawki są dwukrotnie wyższe — 1,32 i 3,96 dolara. Najbardziej wzrosną trafienia w cache: z 0,003625 do 0,022 dolara poza szczytem i 0,044 dolara w szczycie. To zmniejsza zniżkę na cache z około jednej stodwudziestej do jednej trzydziestej regularnej ceny wejściowej. Dla agentów, które wielokrotnie odczytują te same pliki, jest to najbardziej kosztowny element zmiany.
Nowy cennik częściowo odwraca obniżkę cen, którą Deepseek wprowadziło w maju — trafienia w cache będą teraz kosztować więcej niż przed tamtą redukcją. Podwyżka przychodzi w momencie, gdy firma pozyskuje nowy kapitał i przygotowuje się do pierwszej oferty publicznej.
Podsumowując, Deepseek zaczyna traktować swoje API jako źródło przychodu, jednocześnie otwierając infrastrukturę agentową na społeczność — pytanie, czy wyższe koszty nie zniechęcą deweloperów budujących agenty na jego modelach.

Anthropic ujawnia, jak działa system znaków wodnych oparty na SynthID-Text, spełniający wymogi AI Act dla tekstu Claude.

Deweloperzy stworzyli narzędzia obchodzące znaki wodne Claude wymuszone unijnym AI Act, wykorzystując synonimy, tłumaczenia i inne modele językowe.
404 Media namierzyło AirTagiem przesyłkę 1000 książek, która trafiła do centrum Amazona w Las Vegas skanującego zbiory na dane treningowe AI.