3 artykuły z tym tagiem
Nowy model Alibaba autonomicznie budował oprogramowanie przez 16 dni i zwiększył kapitał w symulacji e-commerce czterokrotnie, wyprzedzając ludzkie zespoły.
Nowe badanie ujawnia słabość agentów AI w kodowaniu — pokrywają tylko 14–19% istotnych linijek kodu, choć dobrze radzą sobie z wyszukiwaniem plików.
Chińska firma DeepSeek zapowiada model AI V4, który ma konkurować z systemami od Google, OpenAI i Anthropic. Szczególnie mocny w kodowaniu.