ChatGPT Work potrafi już logować się na strony i wykonywać w nich zadania jak człowiek – dzięki modelowi GPT-5.6 od OpenAI.

Źródło zdjęcia: Spider's Web
ChatGPT Work potrafi już samodzielnie logować się na strony internetowe i wykonywać w nich operacje jak człowiek — to jedna z najbardziej konkretnych zmian, jakie OpenAI wprowadziło w ostatnich miesiącach. Firma od dawna reklamowała ChatGPT Work jako „partnera do najbardziej ambitnych zadań”, ale dopiero teraz to hasło zyskało realne pokrycie w funkcjach: agent może przechodzić przez formularze logowania, pobierać dane z kont, wykonywać operacje w panelach administracyjnych, aktualizować treści i wypełniać dokumenty — bez ciągłego nadzoru użytkownika.
Nowa funkcja nie pojawiłaby się bez GPT-5.6 — modelu, który OpenAI opisuje jako najbardziej zaawansowany dostępny obecnie do pracy profesjonalnej. To on odpowiada za wieloetapowe rozumowanie, planowanie zadań, adaptację do zmian w trakcie ich wykonywania, tworzenie materiałów zgodnych z szablonami i formatami firmy oraz utrzymywanie kontekstu przez wiele godzin pracy.
W praktyce oznacza to, że ChatGPT Work nie tylko „wie”, co zrobić, ale też wie, jak to zrobić — i potrafi samodzielnie przejść przez proces, który normalnie wymagałby zaangażowania pracownika. OpenAI podkreśla przy tym skalę wykorzystania tej technologii: Codex, stojący za agentami mechanizm, jest używany przez ponad 5 mln osób tygodniowo, przy czym ponad milion z nich korzysta z niego do zadań niezwiązanych z programowaniem — czyli właśnie do tego typu operacji jak logowanie się na konta i wykonywanie zadań w przeglądarce.
Zdaniem OpenAI agent nie działa jednak „na ślepo”. Zanim przystąpi do zadania, zbiera kontekst, proponuje plan działania, zadaje pytania i czeka na zatwierdzenie przez użytkownika. Dopiero po akceptacji zaczyna pracę, a proces można w każdej chwili zatrzymać, zmienić jego kierunek lub dodać nowe instrukcje. Firma zapewnia, że wszystko odbywa się w ramach uprawnień użytkownika, z pełną kontrolą nad tym, co agent może zrobić, a wersje biznesowe mają dodatkowe mechanizmy governance i widoczności działań agentów.
Funkcję logowania na strony świetnie uzupełniają nowe zadania zaplanowane, czyli Scheduled Tasks. ChatGPT Work może dzięki nim monitorować zmiany w narzędziach takich jak Teams czy Slack, aktualizować dokumenty i slajdy, wysyłać powiadomienia oraz wykonywać cykliczne operacje w aplikacjach webowych. Innymi słowy — agent może np. co godzinę sprawdzać nowe zgłoszenia, aktualizować dashboard i wysyłać raport, całkowicie bez udziału człowieka.
ChatGPT Work nie działa przy tym w izolacji. Agent może korzystać z ponad 1400 pluginów, łączyć dane z różnych narzędzi, tworzyć dokumenty, slajdy, strony, dashboardy i aplikacje webowe. Może też działać w aplikacji desktopowej ChatGPT, która ma wbudowaną przeglądarkę z obsługą wielu kart. Logowanie do stron to więc tylko jeden element większej układanki — OpenAI chce, by agent stał się „pracownikiem cyfrowym”, zdolnym zbierać dane, analizować je, tworzyć materiały, aktualizować treści i komunikować się z zespołem.
Autor tekstu, redaktor Spider's Web Maciej Gajewski, otwarcie przyznaje, że nowym możliwościom nie ufa. OpenAI zapewnia, że agent działa w ramach uprawnień użytkownika, wymaga zatwierdzenia planu, nie wykonuje działań bez zgody, ma pełną historię operacji, a w wersjach biznesowych działa w ramach governance i audytu. Pytanie, czy to wystarczy, pozostaje jednak otwarte.
Zdaniem autora dostępne dla konsumentów i małych firm modele są wciąż relatywnie małe i skłonne do popełniania błędów — sprawdzają się przy prostych, powtarzalnych zadaniach, skracając czas ich wykonania. Czym innym jest jednak precyzyjne streszczenie kilkudziesięciu maili służbowej korespondencji, a czym innym realne działania mogące wpłynąć na inne podmioty. Pracę odtwórczą można sprawdzić przed jej wykorzystaniem — na weryfikację działań agenta po ich wykonaniu bywa już za późno, a pomyłka może okazać się katastrofalna. Podobne wątpliwości dotyczące kontroli nad autonomicznymi agentami pojawiły się już w innych kontekstach, m.in. w sprawie, w której Alabama wystawiła subpoenę OpenAI po ataku agenta AI.
OpenAI nie kryje, że logowanie do stron to dopiero pierwszy krok. GPT-5.6 ma być fundamentem dla agentów zdolnych wykonywać coraz bardziej złożone zadania — także takie, które dziś wymagają zaangażowania kilku osób i wielu narzędzi jednocześnie. Czy uda się to zrobić bezpiecznie, pokaże czas.
Nowe funkcje ChatGPT Work oznaczają realny skok od AI „symulującej” działanie do AI, która faktycznie wykonuje operacje w systemach firmowych — a wraz z tym rosną pytania o kontrolę, zaufanie i konsekwencje pomyłek, których po fakcie nie da się już odkręcić.

Cerebras zaprezentował akcelerator CS-4, który dzięki lepszemu chłodzeniu i zasilaniu podwaja wydajność WSE-3 i osiąga 4400 tokenów/s na użytkownika.

Startup Generalist AI pokazał roboty, które po jednym filmie instruktażowym improwizują i przenoszą umiejętności na nowe zadania jak małe dzieci.

Nowe badanie pokazuje, że modele świata ignorujące ludzkie przekonania i intencje przewidują błędne działania – framework MWM podnosi wynik F1 z 63,3 do 87,9 punktu.