15 artykułów z tym tagiem
Gowers, Sarnak i badacz DeepMind wskazują, że LLM-y sprawnie łączą znane metody matematyczne, lecz nie potrafią tworzyć zupełnie nowych abstrakcji.
Nieudostępniony model Anthropic znacząco zwiększył dolną granicę rozwiązań hipotezy Riemanna, koordynując pracę 60 pod-agentów przez półtora dnia.
Framework oparty na Artificial Age Score dowodzi, że systemy AI mogą funkcjonować w nieskończonych cyklach bez nieograniczonego starzenia strukturalnego.
Nowy model OpenAI o nazwie Astra rozwiązał dziesięć długoterminowych problemów naukowych za zaledwie 2 tysiące dolarów kosztów obliczeniowych.
OpenAI obalił problem otwarty od 1946 roku. Matematycy podzieleni między entuzjazmem a obawami o przyszłość zawodu i kultury matematycznej.
Model AI Claude Fable znalazł kontrprzykład obalający 90-letnią Hipotezę Jakobianową, jeden z najważniejszych problemów matematyki algebraicznej.
Chiński model Kimi K3 zajął pierwsze miejsce w benchmarku programistycznym, ale osiąga tylko 39% dokładności w zaawansowanych zadaniach matematycznych.
Nowy model Anthropic osiągnął 88% dokładności w FrontierMath tier 4, podczas gdy GPT-5.5 uzyskał 75%. Przełom w matematycznym rozumowaniu AI.
System AlphaProof Nexus rozwiązał 9 problemów Erdősa nierozwiązanych przez dekady, kosztując tylko kilkaset dolarów na problem dzięki połączeniu AI z weryfikacją.
OpenAI przełamuje granice automatycznego rozumowania, rozwiązując problem matematyczny nierozwiązany od 1946 roku dzięki teorii liczb.
SOOHAK odsłania słabości AI: najlepszy model osiągnął 30% w trudnych zadaniach i nie potrafi odmówić odpowiedzi na problemy bez rozwiązania.
Timothy Gowers użył ChatGPT 5.5 Pro do rozwiązania otwartych problemów matematycznych. AI samodzielnie wygenerował prace naukowe na poziomie doktorskim bez pomocy człowieka.