- Début
- 5 août 2025CONFIANCE 90 %selon la source
Sortie de Claude Opus 4.1
Traduit automatiquement de l’original
Titre original: Claude Opus 4.1 Released
- Anthropic a lancé Claude Opus 4.1 le 5 août 2025 pour les utilisateurs payants de Claude, dans Claude Code, ainsi que sur son API, Amazon Bedrock et Vertex AI de Google Cloud, au même prix qu'Opus 4[1][2]
- Il est sorti le même jour où OpenAI a publié ses premiers modèles de raisonnement à poids ouverts depuis 2019 ; Anthropic a déclaré prévoir « des améliorations bien plus importantes de nos modèles dans les semaines à venir »[1][6]
- GitHub l'a intégré à Copilot ce même jour en aperçu public pour les forfaits Enterprise et Pro+[5]
- Comme Opus 4, il est déployé selon la norme de sécurité ASL-3[3]
- Retiré de l'API Claude le 5 août 2026, exactement un an après son lancement, remplacé par Claude Opus 4.8[4]
Caractéristiques notables
- Une amélioration de Claude Opus 4 « sur les tâches agentiques, le codage réel et le raisonnement », avec une meilleure recherche approfondie et analyse de données, « en particulier pour le suivi des détails et la recherche agentique »[1]
- 74.5% sur SWE-bench Verified contre 72.5% pour Opus 4, et 43.3% sur Terminal-Bench contre 39.2%[1][6]
- Autres scores dans le tableau d'Anthropic : 80.9% sur GPQA Diamond, 82.4% sur TAU-bench (vente au détail), 89.5% sur MMMLU et 78.0% sur AIME 2025[1]
- Retours de clients : GitHub observe des gains notables dans la refactorisation multi-fichiers, Rakuten des corrections précises dans de grandes bases de code « sans apporter de modifications inutiles », et Windsurf un saut d'un écart-type par rapport à Opus 4[1]
- Facturé comme Opus 4 à 15 $ par million de jetons en entrée et 75 $ par million de jetons en sortie ; identifiant API claude-opus-4-1-20250805[1][6]
Benchmarks[1]
| Benchmark | Claude Opus 4.1 | Claude Opus 4 | Claude Sonnet 4 | OpenAI o3 | Gemini 2.5 Pro |
|---|---|---|---|---|---|
| SWE-bench Verified¹ (codage agentique) | 74.5% | 72.5% | 72.7% | 69.1% | 67.2% |
| Terminal-Bench² (codage agentique en terminal) | 43.3% | 39.2% | 35.5% | 30.2% | 25.3% |
| GPQA Diamond (raisonnement de niveau doctorat) | 80.9% | 79.6% | 75.4% | 83.3% | 86.4% |
| TAU-bench (utilisation agentique d'outils) | Vente au détail 82.4%, Compagnie aérienne 56.0% | Vente au détail 81.4%, Compagnie aérienne 59.6% | Vente au détail 80.5%, Compagnie aérienne 60.0% | Vente au détail 70.4%, Compagnie aérienne 52.0% | — |
| MMMLU³ (questions-réponses multilingues) | 89.5% | 88.8% | 86.5% | 88.8% | — |
| MMMU, validation (raisonnement visuel) | 77.1% | 76.5% | 74.4% | 82.9% | 82% |
| AIME 2025⁴ (compétition de mathématiques de niveau lycée) | 78.0% | 75.5% | 70.5% | 88.9% | 88% |
¹ Opus 4.1, Opus 4 et Sonnet 4 sont exécutés en pass@1 avec des outils bash/éditeur, moyenne sur 10 essais, correctifs en une seule tentative, sans calcul au moment du test. ² Cadre agent par défaut (Terminus 1), moyenne sur 5 essais. ³ Les scores de Claude sont la moyenne sur 14 langues autres que l'anglais. ⁴ Réalisé avec un échantillonnage nucleus, top_p 0.95.
Références 6CONFIANCE 89 %Confiance globale: 89%Dans quelle mesure la source et les références du pin étayent ses dates.Moyenne pondérée de la fermeté avec laquelle 6 références, source comprise, étayent les heures de début et de fin de l’épingle ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récenteAfficher toutes les épingles à 75 % de confiance ou plus
La première entrée est toujours la source de l’épingle. La confiance globale est une moyenne pondérée de la fermeté avec laquelle chaque référence étaye les heures de début et de fin retenues ci-dessus ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récente.
- [1]90%anthropic.com/news/claude-opus-4-1anthropic.com· Publié le 28 sept. 2026· Début 5 août 2025 ✓· 23 % du score
L'article d'Anthropic[3] est daté du « 5 août 2025 » : « Aujourd'hui, nous lançons Claude[2][4] Opus 4.1 [...] désormais disponible pour les utilisateurs payants de Claude et dans Claude Code. Il est également sur notre API, Amazon Bedrock et Vertex AI de Google Cloud » ; les notes de version de Claude et le changelog de GitHub[5] portent la même date.
- [2]90%Claude Platform release notes - Claude Platform Docsplatform.claude.com· Ajouté le 28 sept. 2026· 23 % du score
"August 5, 2025 We've launched Claude[4] Opus 4.1, an incremental update to Claude Opus 4", which does not allow both temperature and top_p to be set; later entries record structured outputs launching for Opus 4.1 (14 November 2025) and its retirement.
- [3]90%System Card Addendum: Claude Opus 4.1anthropic.com· Ajouté le 28 sept. 2026· 23 % du score
Anthropic's[1] system card addendum: "Like Claude[2][4] Opus 4, Claude Opus 4.1 is deployed under the AI Safety Level 3 (ASL-3) Standard"; it is not "notably more capable" than Opus 4 under the RSP, so new evaluations were voluntary.
- [4]90%Model deprecations - Claude Platform Docsplatform.claude.com· Ajouté le 28 sept. 2026· 23 % du score
Anthropic[1][3] notified developers on 5 June 2026 that Claude[2] Opus 4.1 (claude-opus-4-1-20250805) would be retired; it was retired on 5 August 2026, one year after release, with claude-opus-4-8 as the replacement.
- [5]85%Anthropic Claude Opus 4.1 is now in public preview in GitHub Copilotgithub.blog· Publié le 5 août 2025· Début 5 août 2025· 5 % du score
GitHub's changelog, "Release August 5, 2025": Claude[2][4] Opus 4.1, "the successor to Claude Opus 4", is available in GitHub Copilot Chat for Copilot Enterprise and Pro+ plans on github.com, Visual Studio Code and GitHub Mobile.
Suggérer une correction
Il manque quelque chose ou une erreur s'est glissée ? Dites-le avec vos mots : un lien qui étaye cette épingle, une autre date de début ou de fin et pourquoi, ou une information absente ou erronée. L'IA la vérifie au regard des sources de l'épingle, en cherche de meilleures et ajoute toute page qui vous donne raison. Les sources de l'épingle restent celles qui comptent le plus. L'IA regarde aussi les images : une image qui montre autre chose, ou qui le montre mal, passe en dernier ou est remplacée.