Meta nauczyła mały model AI samodzielnie kończyć zadania
Wynik: 96,9%

W skrócie
96,4%
uzyskał Claude Opus 4.5
Czołowy model za płatnymi narzędziami AI. Uczeń minimalnie go wyprzedził.
49
punktów ponad własny punkt wyjścia
Robotę zrobiły lepsze narzędzia wokół modelu, nie większy mózg.
8B
parametrów
Qwen3-8B uruchamia w domu agentów z najwyższej półki.
89,9%
u najlepszego trenowalnego rywala
Rywale trenowali pod to miesiącami. Prostszy przepis pobił ich wszystkich.
25,7
punktu zyskał GPT-5 na tym samym zestawie
Ten sam trik podbija też GPT-5.
96,9% zadań wykonanych poprawnie.
Źródła
- arxiv.org
- venturebeat.com

