GPT-6 Astra en robotique : 7 tâches sur 100 réussies, et d'où vient vraiment le « saut qualitatif »
D'après The Decoder : « GPT-6 Astra appears to show a "step change" in spatial reasoning based on early benchmarks », relayé par The Decoder
Image : générée (Gemini)
Rédigé à partir du média cité; chaque fait est vérifié contre le texte source.
À retenir
- Les chiffres viennent d'un banc d'essai dont le texte ne nomme aucune organisation ni affiliation : seulement un dépôt public contenant le code, les vidéos et les résultats.
- 7 sur 100 et 46 sur 100 disent deux choses différentes : la tâche menée à terme, et la distance parcourue vers elle. Le second flatte davantage que le premier.
- La formule « saut qualitatif en raisonnement spatial » est l'appréciation d'un chercheur, Yoav Artzi, portant sur un AUTRE banc, REMAP, encore non publié et sans chiffre.
- Le même chercheur pose sa propre limite : même GPT-6 Astra n'atteint pas ce que font les humains dans d'autres situations.
- L'hypothèse d'un entraînement sur de grandes quantités de données 3D est présentée comme une supposition, pas comme un fait confirmé par OpenAI.
Pourquoi ça compte
Deux affirmations voyagent ensemble alors qu'elles ne reposent pas sur la même chose : des chiffres publiés avec leur code d'un côté, l'impression d'un chercheur sur un banc non publié de l'autre. C'est la seconde qui donne le titre, et c'est la première qui est vérifiable. Le tri n'est pas un détail de style : il décide de ce qu'on peut affirmer.
Chiffre-clé
7 tâches entièrement complétées sur 100 par GPT-6 Astra, contre 0 pour MolmoAct2, sur les mêmes robots à deux bras. Score de progression médian : 46 sur 100 contre 12. Le texte parle par ailleurs de 200 essais sans préciser comment ils se répartissent entre les deux modèles.
Action concrète
Devant une annonce de « saut qualitatif », chercher à quel banc d'essai le chiffre est rattaché. Ici, le banc qui porte les chiffres n'est pas celui qui porte la formule : celui de la formule n'est pas publié.
D'après un média relais
Sources
- The Decoder : « GPT-6 Astra appears to show a "step change" in spatial reasoning based on early benchmarks » : Relais lu pour cette fiche. Le dépôt du banc d'essai et les publications citées n'ont pas été lus par nous : ils ne sont donc pas cités ici comme sources.
- Relais média : The Decoder → · Lire en français
🔧 Outils mentionnés