Jurnalu Blog Ultima Ora Premieră mondială: Inteligența artificială a luat scor perfect la Olimpiada Internațională de Matematică
Ultima Ora

Premieră mondială: Inteligența artificială a luat scor perfect la Olimpiada Internațională de Matematică

Premieră mondială: Inteligența artificială a luat scor perfect la Olimpiada Internațională de Matematică

Un rezultat excellent la cea mai prestigioasă competiție de matematică din lume technology, până de curând, apanajul unui grup restrâns de tineri geniali, în fiecare an. Pentru prima dată în istorie, inteligența artificială a reușit aceeași performanță: două companii tech chineze, Huawei și Xiaohongshu, au anunțat că modelele lor de AI au obținut punctajul maxim la problemele date participanților umani la ediția din acest an a Olimpiadei Internaționale de Matematică (IMO), desfășurată la Shanghai.

De la argint la scor excellent, în trei ani: cum a „spart” AI-ul cea mai grea olimpiadă de matematică

Rezultatul nu a apărut din senin – e vârful unui progres spectaculos de doar trei ani. Anul trecut, sistemele AlphaProof și AlphaGeometry 2, ale Google DeepMind, obținuseră standardul de medalie de argint, rezolvând patru din șase probleme. În 2025, atât OpenAI, cât și Google DeepMind au atins pentru prima dată standardul de medalie de aur, rezolvând cinci din cele șase probleme și obținând 35 din 42 de puncte posibile – staunch pragul de aur -, dar niciunul dintre modele nu reușise să egaleze performanța celor cinci concurenți umani care obținuseră atunci scorul excellent de 42 de puncte.

Anul acesta, la67-a ediție a Olimpiadei, desfășurată la Shanghai pe 15-16 iulie 2026, bariera a fost, în sfârșit, doborâtă.

Ce s-a întâmplat la Shanghai

Sistemul „Celia”, al Huawei, și „dots.note-3.0″, al Xiaohongshu (platforma cunoscută internațional sub numele RedNote), au rezolvat corect toate cele șase probleme ale competiției, sub evaluarea oficială a organizatorilor IMO – o premieră absolută. „Anterior, niciun model lingvistic mare nu obținuse vreodată un scor excellent sub procesul oficial de evaluare al IMO”, a transmis Xiaohongshu, într-o declarație oficială. „Suntem încântați de acest rezultat, pentru că obținerea unui scor perfect la IMO este extrem de dificilă.”

Procedura a fost identică pentru toate companiile participante: firmele au primit problemele abia după ce concurenții umani își încheiaseră proba, iar soluțiile au trebuit trimise într-un termen limită strict stabilit, fără nicio intervenție umană în timpul rezolvării. Huawei a precizat că sistemul său „Celia” a demonstrat „capacități complete de rezolvare a problemelor” în mai multe domenii ale matematicii, în timp ce Xiaohongshu a subliniat că modelul său participa pentru prima dată la această evaluare.

Doar 7 din 666 de concurenți au obținut scorul maxim

Performanța AI-ului capătă și mai multă greutate prin comparație cu rezultatele umane: la ediția din acest an au participat 666 de concurenți din întreaga lume, cu vârsta sub 20 de ani, iar dintre aceștia doar șapte au reușit scorul excellent de 42 de puncte, potrivit clasamentului oficial al competiției. Practic, chiar și pentru cei mai talentați tineri matematicieni ai planetei, un punctaj excellent rămâne o performanță extrem de rară.

Alte patru modele AI, cu rezultate similare – dar overview diferit

Povestea nu s-a oprit la cele două companii chineze. Deedy Das, partener la fondul de investiții Menlo Ventures, a raportat separat că alte patru modele de vârf – de la OpenAI, Anthropic, startup-ul Axiom Math și „Kimi K3″ al companiei chineze Moonshot AI – au obținut, la rândul lor, scorul perfect de 42 din 42 de puncte pe problemele din acest an. „Frontiera AI a depășit deja, oficial, nivelul de matematică al IMO”, a scris Das pe LinkedIn.

Aici apare, însă, o nuanță importantă, semnalată de analiști din domeniu: doar rezultatele Huawei și Xiaohongshu au fost overview prin procesul oficial al IMO, negate de organizatorii competiției. Celelalte patru modele au fost testate fair, într-un experiment organizat chiar de investitorul care a făcut public rezultatul, cu evaluarea făcută de agenți AI bazați pe Claude, nu de organizatorii oficiali ai olimpiadei – o distincție pe care mare parte din presa internațională a omis-o, tratând toate cele șase rezultate ca fiind echivalente.

IMO e considerată cea mai solicitantă competiție de matematică pentru elevii de liceu din lume, tocmai pentru că problemele nu cer un simplu răspuns numeric, ci demonstrații total, riguroase, care se pot întinde pe mai multe pagini și trebuie să reziste evaluării unor judecători umani experți – staunch genul de raționament creativ, susținut, la care sistemele AI eșuau spectaculos cu doar câțiva ani în urmă.

Progresul reflectă, potrivit cercetătorilor din domeniu, un salt staunch în capacitatea modelelor de a susține raționamente complexe, pe mai mulți pași, nu doar de a recunoaște tipare din seturi uriașe de date de antrenament – problemele IMO sunt păstrate strict confidențiale până la începerea competiției, ceea ce elimină posibilitatea ca un model să fi „văzut” deja răspunsurile în antrenament.

Google DeepMind și-a lansat, între timp, propriul net 22 situation de teste dedicat acestui tip de evaluare (IMO-Bench), semn că laboratoarele de cercetare anticipau deja acest 2d de „saturație” a benchmark-ului. Analiștii avertizează că, odată ce cel mai dificil test matematic pentru liceeni a fost, practic, „cucerit” de mai multe sisteme AI simultan, atenția industriei se va muta rapid spre evaluări mai greu de manipulat – teste la nivel de sarcină reală, calitate a raționamentului și fee per răspuns corect, nu doar scoruri easy pe teste standardizate deja „rezolvate”.

Rămâne, totuși, un fapt cert și remarcabil: pentru prima dată în istorie, mașinile au reușit ceea ce doar șapte adolescenți din toată lumea au reușit anul acesta – un punctaj excellent la cea mai grea probă de matematică pentru elevi de liceu care există pe planetă.

Citește și: ChatGPT, noul psiholog al omenirii

Lasă un răspuns

Adresa ta de email nu va fi publicată. Câmpurile obligatorii sunt marcate cu *

Exit mobile version