Claude Opus 4.7 : le nouveau modèle IA d'Anthropic
Anthropic dévoile Claude Opus 4.7, un modèle IA optimisé pour les tâches complexes et l'usage 'agentique'. Il surpasse son prédécesseur avec des scores de 64,3% sur SWE-bench Pro et 87,6% sur SWE-bench Verified, tout en restant derrière Mythos.
« Opus 4.7 atteint 64,3%, contre 53,4% pour Opus 4.6, 57,7% pour GPT‑5.4 et 54,2% pour Gemini 3.1 Pro, tandis que Mythos culmine à 77,8%. » — Numerama
Que faut-il retenir ?
- Opus 4.7 atteint 64,3% sur SWE-bench Pro contre 53,4% pour Opus 4.6.
- Le modèle monte à 87,6% sur SWE-bench Verified contre 80,8% pour Opus 4.6.
- En analyse financière, Opus 4.7 atteint 64,4% contre 60,1% pour Opus 4.6.
- La tarification reste à 5 dollars par million de jetons en entrée, 25 dollars en sortie.
Pourquoi cette nouvelle compte-t-elle ?
Claude Opus 4.7 représente une avancée significative pour les développeurs et entreprises utilisant l'IA pour des tâches complexes. Ses améliorations en ingénierie logicielle et en analyse d'images en font un outil plus fiable et créatif. La gestion améliorée de la mémoire et la tarification inchangée en font une option attractive malgré une consommation potentiellement accrue de jetons.
64,3% sur SWE-bench Pro pour Opus 4.7
Public concerné : développeurs, entreprises
Quelles sont les principales améliorations de Claude Opus 4.7 par rapport à Opus 4.6 ?
Claude Opus 4.7 offre des performances supérieures en ingénierie logicielle, avec des scores de 64,3% sur SWE-bench Pro contre 53,4% pour Opus 4.6. Il améliore aussi l'analyse d'images et la gestion de la mémoire, tout en maintenant la même tarification.