L’esame che doveva mettere in crisi l’AI ora mette in crisi i ricercatori

Humanity's Last Exam era nato per mettere in difficoltà qualunque modello AI, ma in un anno i punteggi sono cresciuti rapidamente. Il caso apre una domanda più ampia: i benchmark statici riescono ancora a misurare davvero le capacità dell’intelligenza artificiale? L'articolo L’esame che doveva mettere in crisi l’AI ora mette in crisi i ricercatori proviene da Agenda Digitale.

Lug 21, 2026 - 11:21
 0  0
L’esame che doveva mettere in crisi l’AI ora mette in crisi i ricercatori
Humanity's Last Exam era nato per mettere in difficoltà qualunque modello AI, ma in un anno i punteggi sono cresciuti rapidamente. Il caso apre una domanda più ampia: i benchmark statici riescono ancora a misurare davvero le capacità dell’intelligenza artificiale? L'articolo L’esame che doveva mettere in crisi l’AI ora mette in crisi i ricercatori proviene da Agenda Digitale.
Agenda Digitale Il giornale sull'agenda digitale italiana

Questo sito utilizza i cookie. Continuando a navigare nel sito accetterai l'uso dei cookie.