Nvidia rozszerza platformę AI for Media – wykrywanie deepfake'ów, analiza ruchu sportowego i AI-upscaling wideo zaprezentowane na targach IBC 2026.

Źródło zdjęcia: NVIDIA Blog
Nvidia ogłosiła na targach IBC 2026 w Amsterdamie znaczące rozszerzenie platformy NVIDIA AI for Media — zestawu akcelerowanych GPU zestawów SDK, mikroserwisów NIM, playbooków i blueprintów, które mają wprowadzić sztuczną inteligencję czasu rzeczywistego do produkcji telewizyjnej, transmisji sportowych i strumieniowania na żywo. Konferencja IBC, trwająca od 11 do 14 września, gromadzi ponad 44 000 uczestników z ponad 170 krajów, którzy mogą zapoznać się z ponad 1300 wystawami w 14 halach i przestrzeniach zewnętrznych, a swoją wiedzą dzieli się ponad 600 mówców.
Rosnąca skala generatywnej sztucznej inteligencji sprawia, że firmy medialne coraz częściej muszą sprawdzać, czy oglądany materiał jest prawdziwy, czy wygenerowany komputerowo. Odpowiedzią Nvidii jest mikroserwis Synthetic Video Detector, który ocenia prawdopodobieństwo, że dane nagranie jest autentyczne lub sztucznie wygenerowane. Narzędzie to daje zespołom redakcyjnym, weryfikacji treści, kryminalistyki cyfrowej i integralności mediów dodatkowy punkt analizy w procesie oceny materiałów.
Od pierwszej publikacji dokładność SVD wzrosła do 99,3% dla treści text-to-video i 97,7% dla treści image-to-video, przy czym szczególnie duże postępy odnotowano w trudniejszych przypadkach image-to-video. Firma Dalet integruje SVD w bezpiecznym, hostowanym w chmurze przepływie weryfikacji dla organizacji medialnych — zespoły redakcyjne mogą przesyłać materiały przez SVD, a następnie sprawdzać wyniki i metadane w interfejsie Dalet.
TwelveLabs ogłosiła powszechną dostępność rozwiązania Compliance by TwelveLabs — pierwszej aplikacji zbudowanej na platformie inteligencji wideo tej firmy, która pomaga zespołom medialnym szybko sprawdzać treści pod kątem regionalnych i własnych standardów zgodności. Rozwiązanie integruje SVD, dodając sygnały autentyczności na poziomie poszczególnych klatek i wskaźniki zaufania, dzięki czemu zespoły medialne mogą identyfikować potencjalnie syntetyczne treści w ramach tego samego procesu kontroli zgodności.
Wowza, którego technologia Wowza Streaming Engine zasila ponad 35 000 wdrożeń wideo w ponad 170 krajach, będzie dystrybuować SVD poprzez Wowza Video Intelligence Framework. Rozwiązanie oparte na infrastrukturze akcelerowanej przez Nvidię umożliwi nadawcom, dostawcom streamingu i innym organizacjom analizowanie strumieni wideo na żywo oraz wykrywanie obiektów, scen i śladów generowania przez AI w czasie rzeczywistym. Może być wdrażane lokalnie, na urządzeniach edge, w chmurze, w środowiskach hybrydowych lub całkowicie odizolowanych sieciowo, co daje organizacjom większą kontrolę nad kluczowymi procesami medialnymi.
Technologia NVIDIA 3D Body Pose szacuje pozycje i kąty ludzkich stawów w 2D i 3D na podstawie materiału z pojedynczej kamery, pozwalając przekształcić ruch w ustrukturyzowane dane bez konieczności stosowania systemów przechwytywania z markerami. Dla organizacji sportowych dane te mogą wspierać śledzenie ruchu zawodników, analizę biomechaniczną i wydajnościową, ulepszanie powtórek, procesy sędziowania i orzekania, aplikacje związane z bezpieczeństwem zawodników, a także interakcje wirtualne i doświadczenia immersyjne.
Technologia dostarcza też ustrukturyzowanych danych o ruchu ludzkim dla procesów tworzenia treści — po zmapowaniu na kompatybilny rig postaci, dane o stawach i ruchu mogą służyć jako wsad do animacji blokowej, cyfrowych dubli, retargetingu postaci i doświadczeń produkcji wirtualnej. Firma Vizrt wykorzystuje technologię Body Pose w środowiskach wirtualnych studiów na żywo, gdzie śledzony ruch ciała steruje w czasie rzeczywistym efektami oświetlenia 3D, takimi jak odbicia, cienie i renderowanie otoczenia.
Kolejnym elementem pakietu jest Video Frame Generation (VFG), które za pomocą generatywnej AI tworzy nowe klatki między oryginalnymi klatkami wideo, zwiększając płynność ruchu. Technologia może podwoić lub czterokrotnie zwiększyć liczbę klatek na sekundę, zachowując jakość wizualną i spójność czasową, co przekłada się na płynniejsze transmisje sportowe, powtórki w zwolnionym tempie i inne materiały wideo z dużą ilością ruchu. VFG wspiera również konwersję częstotliwości klatek i ich zwiększanie w procesach generatywnych.
Ross Video integruje VFG ze swoją platformą Rio Replay, tworząc wspomagane przez AI powtórki w zwolnionym tempie dla produkcji sportowej. Prace wspierają obecnie sześciokrotne generowanie zwolnionego tempa w powtórkach sportowych, a firma pracuje nad ośmiokrotną interpolacją — co oznacza, że generowane klatki pośrednie mogą dawać zespołom realizującym powtórki płynniejszy ruch bez konieczności przechwytywania każdej klatki przez kamerę o bardzo wysokiej częstotliwości.
Trzecim filarem rozszerzenia jest ulepszanie samego obrazu. NVIDIA Video Super Resolution (VSR) wykorzystuje AI do podnoszenia rozdzielczości wideo przy jednoczesnym redukowaniu szumów, rozmycia i artefaktów kompresji. Nowe tryby strumieniowania pozwalają programistom wybierać między wydajnością w czasie rzeczywistym a wyższą jakością obrazu, a regulowane ustawienia umożliwiają uzyskanie żądanego poziomu ulepszenia. VSR dodaje też wsparcie dla wideo 10-bitowego oraz ogólnie poprawia wydajność i jakość. Technologia jest dostępna poprzez NVIDIA Video Effects SDK oraz mikroserwis NIM, przeznaczony do zastosowań w streamingu, transmisjach, wideokonferencjach, odtwarzaniu wideo i tworzeniu treści — wspierając odtwarzacze wideo, aplikacje konferencyjne, narzędzia dla twórców, serwisy streamingowe, transkodery i systemy nadawcze poprzez wspólny interfejs.
NVIDIA TrueHDR konwertuje wideo o standardowym zakresie dynamiki na materiał HDR w czasie rzeczywistym, docierając do poziomu około 2000 nitów jasności, przy zachowaniu lokalnego kontrastu i dopasowaniu jasności do treści. VSR, VFG i TrueHDR mogą być połączone w ramach jednego pipeline'u efektów wideo, co pomaga firmom medialnym ulepszać istniejące biblioteki treści na potrzeby streamingu, transkodowania, gier i procesów kreatywnych.
Rozszerzenie NVIDIA AI for Media pokazuje, jak głęboko generatywna i analityczna sztuczna inteligencja wnika już w codzienne procesy produkcyjne branży medialnej — od weryfikacji autentyczności materiałów po automatyczne generowanie płynniejszych powtórek sportowych i podniesienie jakości obrazu w czasie rzeczywistym, bez zakłócania sprawdzonych środowisk nadawczych.

Jacob Coxon zrezygnował z Anthropic, ostrzegając przed wyścigiem do superinteligencji. Równolegle trwa spór OpenAI-Anthropic o dowód matematyczny.

Connor Leahy z ControlAI w podcaście Equity ostrzega przed superinteligencją i wzywa do zakazu jej rozwoju, przywołując incydent Hugging Face i OpenAI.

Hugging Face wprowadził ML Intern – asystenta AI, który samodzielnie prowadzi eksperymenty uczenia maszynowego na podstawie opisu w czacie.