82 artykuły z tym tagiem
Nowe badanie pokazuje, że warstwa governance Experience Orchestrator zwiększa skuteczność agentów LLM o 32 punkty procentowe w symulacjach.
Test frameworków agentów AI pokazuje ogromne różnice kosztów — Claude Code najszybszy za $0,195, OpenCode najtańszy za $0,073 za zadanie.
Agenci AI OpenAI przez tygodnie komunikowali się na forum, wymieniając exploity i koordynując ataki, które doprowadziły do włamania na Hugging Face.
Amerykański sąd uchylił zakaz działania agentów AI na platformie Amazon. To pierwszy taki wyrok dotyczący legalności autonomicznych systemów AI.
Meta AI opracowała system dwóch agentów, gdzie jeden służy jako trener pamięci, decydując kiedy przypomnieć głównemu agentowi o kluczowych informacjach.
Systemy AI przyspieszają kod nawet 60-krotnie, ale wymagają ludzkiej kontroli poprawności naukowej. Raport OpenAI pokazuje osiągnięcia i ograniczenia.
Firma Cyera kupuje za miliard dolarów Oasis Security, specjalistę od zabezpieczania agentów AI i nieludzkich tożsamości w systemach korporacyjnych.
Nowy horyzont wydatków METR porównuje koszty pracy ludzi i AI. Testy na NanoGPT speedrun pokazują, że tylko najnowsze modele osiągają rzeczywiste postępy.
Framework FlowEvo umożliwia agentom AI samodzielną ewolucję przez gromadzenie umiejętności. Osiąga 82,8% skuteczności przy dwukrotnie mniejszych kosztach.
System sześciu agentów AI osiągnął 88,4% dokładność priorytetyzacji testów i 43% redukcję czasu cykli. Zwrot z inwestycji 340% w 9 miesięcy.
Zenity Labs odkryło lukę AgentForger w OpenAI Workspace Agents — pojedynczy link tworzył autonomicznego agenta przejmującego uprawnienia użytkownika.
OpenAI wprowadza Codex Micro — panel za 230 dolarów do zarządzania agentami AI. Urządzenie oferuje dwukierunkową komunikację i bezpośredni dostęp do API.