Un benchmark révèle que le nouveau modèle bat les humains sur 94 % des tâches, sauf remplir un formulaire Cerfa
Publiés ce mercredi par un consortium de onze universités européennes, les résultats du benchmark HumanEdge 2.0 confirment la supériorité du dernier grand modèle de langage sur l'être humain dans presque tous les domaines. Presque.












