82 artykuły z tym tagiem
Badanie pokazuje, że Claude Code i Codex źle szacują czas zadań i przeceniają jakość swojej pracy nawet o 20 punktów procentowych.
Warp opisuje, jak dwuwarstwowy system skilli i ludzki feedback pozwalają agentom AI na Claude Platform stale poprawiać swoją jakość.
Raport Thomson Reuters: 91% profesjonalistów uważa, że ich firma nie osiąga wartości z AI. Kluczem jest walka z 'tool blast' i mocne use case'y.
Deloitte, KPMG i Accenture-Wharton zgodnie wskazują: adopcja agentów AI rośnie szybciej niż odpowiedzialność, governance i gotowość procesów w firmach.
Badanie na zbiorze eICU porównuje LLM i pipeline agentowy w wyjaśnianiu predykcji śmiertelności na OIT – wyniki są niejednoznaczne.
OpenAI rozwija „Persistent mode” dla Codex – agenta AI, który działa bez przerwy i sam tworzy zadania po zakończeniu pracy.
Startup Instinct zdobył 250 mln dolarów w rundzie Series B, osiągając wycenę 2,5 mld dolarów mimo kontrowersji wokół prywatności danych.
Open Executive to darmowy, otwarty system AI z ośmioma agentami-dyrektorami, tworzony jako odpowiedź na zwalnianie programistów na rzecz sztucznej inteligencji.
ChatGPT Work potrafi już logować się na strony i wykonywać w nich zadania jak człowiek – dzięki modelowi GPT-5.6 od OpenAI.
Radar transkrybuje 130 tys. podcastów i udostępnia dane przez API, przyciągając fundusze hedgingowe i agenty AI szukające niewidocznych danych.
Indyjski startup Ringg pozyskał 10 mln dolarów od Peak XV Partners, rozwijając agentów głosowych AI poza prostą obsługę połączeń telefonicznych.
Gemini Enterprise for Legal automatyzuje przegląd umów i badania prawne, łącząc AI Google z iManage, DocuSign i Harvey.