45 artykułów z tym tagiem
Replikacja badania nad α-FLOPs pokazuje, że liczba operacji FLOP-ów słabo szacuje realny czas wykonania na nowszym sprzęcie AI.
Nowy benchmark IntegrityBench pokazuje, że modele AI pod presją zawodzą w co trzeciej decyzji kluczowej dla rzetelności badań naukowych.
Nowa praca pozycyjna z ICML 2026 dowodzi, że definicyjna niejasność podważa wiarygodność testów rozumowania modeli AI.
Nieudostępniony model Anthropic znacząco zwiększył dolną granicę rozwiązań hipotezy Riemanna, koordynując pracę 60 pod-agentów przez półtora dnia.
OpenAI obalił problem otwarty od 1946 roku. Matematycy podzieleni między entuzjazmem a obawami o przyszłość zawodu i kultury matematycznej.
Google przekaże 40 mln dolarów w tokenach AI dla naukowców Genesis Mission. Narzędzia jak AlphaEvolve i Gemini już przyspieszają badania w laboratoriach DOE.
Badanie pokazuje, że modele AI są o 65% bardziej skłonne do stereotypizowania kandydatów do pracy niż ludzie, co rodzi pytania o sprawiedliwość.
Uczniowie używający AI mieli lepsze oceny z prac domowych, ale ich wyniki na egzaminach spadły nawet o 24%. Pełna skala problemów ujawniła się dopiero po latach.
Nowa metoda australijskich naukowców zwiększa skuteczność wykrywania twarzy AI z 41% do 81% poprzez analizę sześciu ogólnych cech zamiast szukania błędów.
Badacze z UW wykazali, że poprawa modeli AI w kolejnych turach często nie wynika z informacji zwrotnej, lecz z ponownych prób i dodatkowych obliczeń.
Koncepcja AI-ModelNet ma połączyć różne modele AI w globalną sieć na wzór internetu, umożliwiając współdzielenie możliwości i wspólne rozumowanie.
Derya Unutmaz wykorzystał GPT-5 Pro do wyjaśnienia wpływu glukozy na komórki T. Model przewidział też wyniki nieopublikowanych eksperymentów z chłoniakiem.