- Début
- 17 févr. 2026CONFIANCE 90 %selon la source
Sortie de Claude Sonnet 4.6
Traduit automatiquement de l’original
Titre original: Claude Sonnet 4.6 Released
- « Claude Sonnet 4.6 est notre modèle Sonnet le plus performant à ce jour », une amélioration complète en codage, utilisation d'ordinateur, raisonnement sur contexte long, planification d'agents, travail de connaissance et conception[1][4]
- Il est devenu le modèle par défaut sur claude.ai et Claude Cowork pour les utilisateurs Free et Pro, et le forfait gratuit a gagné la création de fichiers, les connecteurs, les compétences et la compaction ; il est disponible sur tous les forfaits Claude, Claude Code, l'API et toutes les principales plateformes cloud[1][3][4]
- Dans Claude Code, les premiers testeurs l'ont préféré à Sonnet 4.5 environ 70% du temps et même à Opus 4.5, le modèle phare d'Anthropic de novembre, 59% du temps, le jugeant moins sujet à la surconception et à la « paresse »[1]
- Les chercheurs en sécurité ont trouvé « un caractère globalement chaleureux, honnête, prosocial et parfois drôle » et aucun signe de désalignement majeur à fort enjeu ; il résiste bien mieux aux injections d'invites que Sonnet 4.5 et a été lancé sous ASL-3[1][5]
- CNBC a associé le lancement à une vague de ventes sur les valeurs technologiques du logiciel, l'ETF logiciel IGV chutant de plus de 20% depuis le début de l'année[3]
Caractéristiques notables
- Prix inchangé par rapport à Sonnet 4.5 : 3 $ par million de jetons en entrée et 15 $ par million de jetons en sortie ; une fenêtre de contexte de 1M jetons (en bêta au lancement) et une sortie maximale de 128K[1][2]
- Le tableau d'Anthropic : 79.6% sur SWE-bench Verified, 72.5% sur OSWorld-Verified (Sonnet 4.5 : 61.4%), 59.1% sur Terminal-Bench 2.0 et 74.7% sur BrowseComp[1]
- Son graphique OSWorld retrace la ligne Sonnet depuis 14.9% pour le Claude 3.5 Sonnet d'octobre 2024 jusqu'à 72.5% pour Sonnet 4.6[1]
- Réflexion adaptative et étendue, plus une compaction de contexte en bêta qui résume le contexte ancien lorsqu'une conversation approche de sa limite[1][2]
- Il égale Opus 4.6 sur OfficeQA, le test de Databricks pour la lecture de graphiques, PDF et tableaux d'entreprise, et dans Vending-Bench Arena, il a beaucoup investi pendant dix mois simulés avant de basculer vers la rentabilité[1]
Benchmarks[1]
| Benchmark | Sonnet 4.6 | Sonnet 4.5 | Opus 4.6 | Opus 4.5 | Gemini 3 Pro | GPT-5.2 (all models) |
|---|---|---|---|---|---|---|
| Codage agentique en terminal (Terminal-Bench 2.0) | 59.1% | 51.0% | 65.4% | 59.8% | 56.2% (54.2% self-reported) | 64.7% (64.0% self-reported, Codex CLI) |
| Codage agentique (SWE-bench Verified) | 79.6% | 77.2% | 80.8% | 80.9% | 78.0% (Flash) | 80.0% |
| Utilisation agentique d'ordinateur (OSWorld-Verified) | 72.5% | 61.4% | 72.7% | 66.3% | — | 38.2% |
| Utilisation agentique d'outils (τ2-bench), vente au détail | 91.7% | 86.2% | 91.9% | 88.9% | 85.3% | 82.0% |
| Utilisation agentique d'outils (τ2-bench), télécoms | 97.9% | 98.0% | 99.3% | 98.2% | 98.0% | 98.7% |
| Utilisation d'outils à grande échelle (MCP-Atlas) | 61.3% | 43.8% | 59.5% | 62.3% | 54.1% | 60.6% |
| Recherche agentique (BrowseComp) | 74.7% | 43.9% | 84.0% | 67.8% | 59.2% (Deep Research) | 77.9% (Pro) |
| Raisonnement multidisciplinaire (Humanity's Last Exam), sans outils | 33.2% | 17.7% | 40.0% | 30.8% | 37.5% | 36.6% (Pro) |
| Raisonnement multidisciplinaire (Humanity's Last Exam), avec outils | 49.0% | 33.6% | 53.0% | 43.4% | 45.8% | 50.0% (Pro) |
| Analyse financière agentique (Finance Agent v1.1) | 63.3% | 54.5% | 60.1% | 58.8% | 55.2% | 59.0% |
| Tâches de bureau (GDPval-AA Elo) | 1633 | 1276 | 1606 | 1416 | 1201 | 1462 |
| Résolution de nouveaux problèmes (ARC-AGI-2) | 58.3% | 13.6% | 68.8% | 37.6% | 31.1% | 54.2% (Pro) |
| Raisonnement de niveau doctorat (GPQA Diamond) | 89.9% | 83.4% | 91.3% | 87.0% | 91.9% | 93.2% (Pro) |
| Raisonnement visuel (MMMU-Pro), sans outils | 74.5% | 63.4% | 73.9% | 70.6% | 81.0% | 79.5% |
| Raisonnement visuel (MMMU-Pro), avec outils | 75.6% | 68.9% | 77.3% | 73.9% | — | 80.4% |
| Questions-réponses multilingues (MMMLU) | 89.3% | 89.5% | 91.1% | 90.8% | 91.8% | 89.6% |
Références 5CONFIANCE 88 %Confiance globale: 88%Dans quelle mesure la source et les références du pin étayent ses dates.Moyenne pondérée de la fermeté avec laquelle 5 références, source comprise, étayent les heures de début et de fin de l’épingle ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récenteAfficher toutes les épingles à 75 % de confiance ou plus
La première entrée est toujours la source de l’épingle. La confiance globale est une moyenne pondérée de la fermeté avec laquelle chaque référence étaye les heures de début et de fin retenues ci-dessus ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récente.
- [1]90%anthropic.com/news/claude-sonnet-4-6anthropic.com· Publié le 28 sept. 2026· Début 17 févr. 2026 ✓· 31 % du score
L'article est daté du « 17 février 2026 » et indique : « Claude[2] Sonnet 4.6 est désormais disponible sur tous les forfaits Claude, Claude Cowork, Claude Code, notre API et toutes les principales plateformes cloud » ; la page de documentation du modèle indique « Sorti le 17 février 2026 » et CNBC[3] en a rendu compte ce jour-là.
- [2]90%Claude Sonnet 4.6 - Claude Platform Docsplatform.claude.com· Ajouté le 28 sept. 2026· 31 % du score
Anthropic's[1][5] model page: claude-sonnet-4-6, 1M-token context, 128K max output (300K Batch beta), $3/$15 per million tokens, adaptive thinking (extended deprecated), text and images in, an August 2025 reliable knowledge cutoff, "Released February 17, 2026".
- [3]85%Anthropic releases Claude Sonnet 4.6, continuing breakneck pace of AI model releasescnbc.com· Publié le 17 févr. 2026· Début 17 févr. 2026· 13 % du score
CNBC, 2026-02-17: the default for free and Pro users in Claude[2] and Claude Cowork, better at computers, coding, design and knowledge work; Anthropic's[1][5] advances had fed a sell-off in software stocks, with the iShares Expanded Tech-Software Sector ETF (IGV) down more than 20% for the year.
- [4]80%Claude Sonnet 4.6 Brings Improved Coding, Computer Use, and Office Tasksmacrumors.com· Publié le 17 févr. 2026· Début 17 févr. 2026· 13 % du score
MacRumors, 2026-02-17: "Anthropic[1][5] today updated its Sonnet model to version 4.6", available on all Claude[2] plans, with file creation, connectors, skills and compaction added for free users; Opus 4.6 stays the better choice for the hardest agentic work.
- [5]90%System Card: Claude Sonnet 4.6anthropic.com· Publié le 17 févr. 2026· 13 % du score
Anthropic's[1] system card dated "February 17, 2026", which records the model's release under the AI Safety Level 3 (ASL-3) Standard; a 6 March 2026 changelog entry updated its BrowseComp scores after an improved cheating-detection pipeline.
Suggérer une correction
Il manque quelque chose ou une erreur s'est glissée ? Dites-le avec vos mots : un lien qui étaye cette épingle, une autre date de début ou de fin et pourquoi, ou une information absente ou erronée. L'IA la vérifie au regard des sources de l'épingle, en cherche de meilleures et ajoute toute page qui vous donne raison. Les sources de l'épingle restent celles qui comptent le plus. L'IA regarde aussi les images : une image qui montre autre chose, ou qui le montre mal, passe en dernier ou est remplacée.