Toutes les news taguées avec ce sujet.
Un nouveau benchmark mesure la capacité des modèles à concevoir des expériences et interpréter des résultats, comparée à celle de chercheurs humains.