- Début
- 4 mars 2024CONFIANCE 95 %selon anthropic.com
Sortie de Claude 3 Sonnet
Traduit automatiquement de l’original
Titre original: Claude 3 Sonnet Released
- Anthropic a annoncé la famille Claude 3 - Haiku, Sonnet et Opus - le 4 mars 2024, Opus et Sonnet étant « désormais disponibles sur claude.ai et l'API Claude », devenue généralement disponible dans 159 pays ; Haiku devait suivre[3]
- Sonnet alimente « l'expérience gratuite sur claude.ai », Opus étant réservé aux abonnés Claude Pro, et a été lancé le même jour sur Amazon Bedrock et en aperçu privé sur Vertex AI Model Garden de Google Cloud[3][4]
- Anthropic l'a présenté comme le modèle qui « trouve l'équilibre idéal entre intelligence et rapidité, en particulier pour les charges de travail d'entreprise », et deux fois plus rapide que Claude 2 et Claude 2.1 pour la plupart des charges de travail[3][4]
- La famille est restée au niveau de sécurité IA 2 (ASL-2) selon la politique de mise à l'échelle responsable d'Anthropic, et refuse bien moins souvent que les précédents modèles Claude des requêtes inoffensives proches de ses garde-fous[3]
- Quand Anthropic a retiré Claude 3 Sonnet en juillet 2025, environ 200 personnes se sont réunies à San Francisco pour des « funérailles »[2]
Caractéristiques notables
- Facturé 3 $ par million de jetons en entrée et 15 $ par million de jetons en sortie, avec une fenêtre de contexte de 200K jetons[3]
- La première génération de Claude dotée de la vision : elle lit des photos, des graphiques et des schémas techniques, jusqu'à 20 images par requête, bien qu'Anthropic l'ait empêchée d'identifier des personnes[1][5]
- Résultats de la fiche modèle : 79.0% sur MMLU (5-shot), 40.4% sur GPQA Diamond, 92.3% sur GSM8K et 73.0% sur le codage Python de HumanEval[1]
- Entraîné sur du matériel Amazon Web Services et Google Cloud avec PyTorch, JAX et Triton ; il répond à partir de données antérieures à août 2023 et ne peut pas effectuer de recherches sur le web[1][5]
- Utilisations suggérées par Anthropic : recherche dans de grandes bases de connaissances, recommandations de produits et prévisions, génération de code et extraction de texte à partir d'images[3]
Benchmarks[3]
| Benchmark | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| Connaissances de niveau licence (MMLU) | 86.8% (5-shot) | 79.0% (5-shot) | 75.2% (5-shot) | 86.4% (5-shot) | 70.0% (5-shot) | 83.7% (5-shot) | 71.8% (5-shot) |
| Raisonnement de niveau doctorat (GPQA, Diamond) | 50.4% (0-shot CoT) | 40.4% (0-shot CoT) | 33.3% (0-shot CoT) | 35.7% (0-shot CoT) | 28.1% (0-shot CoT) | — | — |
| Mathématiques de niveau primaire (GSM8K) | 95.0% (0-shot CoT) | 92.3% (0-shot CoT) | 88.9% (0-shot CoT) | 92.0% (5-shot CoT) | 57.1% (5-shot) | 94.4% (Maj1@32) | 86.5% (Maj1@32) |
| Résolution de problèmes mathématiques (MATH) | 60.1% (0-shot CoT) | 43.1% (0-shot CoT) | 38.9% (0-shot CoT) | 52.9% (4-shot) | 34.1% (4-shot) | 53.2% (4-shot) | 32.6% (4-shot) |
| Mathématiques multilingues (MGSM) | 90.7% (0-shot) | 83.5% (0-shot) | 75.1% (0-shot) | 74.5% (8-shot) | — | 79.0% (8-shot) | 63.5% (8-shot) |
| Code (HumanEval) | 84.9% (0-shot) | 73.0% (0-shot) | 75.9% (0-shot) | 67.0% (0-shot) | 48.1% (0-shot) | 74.4% (0-shot) | 67.7% (0-shot) |
| Raisonnement sur texte (DROP, F1 score) | 83.1 (3-shot) | 78.9 (3-shot) | 78.4 (3-shot) | 80.9 (3-shot) | 64.1 (3-shot) | 82.4 (variable shots) | 74.1 (variable shots) |
| Évaluations mixtes (BIG-Bench-Hard) | 86.8% (3-shot CoT) | 82.9% (3-shot CoT) | 73.7% (3-shot CoT) | 83.1% (3-shot CoT) | 66.6% (3-shot CoT) | 83.6% (3-shot CoT) | 75.0% (3-shot CoT) |
| Questions-réponses de connaissances (ARC-Challenge) | 96.4% (25-shot) | 93.2% (25-shot) | 89.2% (25-shot) | 96.3% (25-shot) | 85.2% (25-shot) | — | — |
| Connaissances générales (HellaSwag) | 95.4% (10-shot) | 89.0% (10-shot) | 85.9% (10-shot) | 95.3% (10-shot) | 85.5% (10-shot) | 87.8% (10-shot) | 84.7% (10-shot) |
Références 5CONFIANCE 83 %Confiance globale: 83%Dans quelle mesure la source et les références du pin étayent ses dates.Moyenne pondérée de la fermeté avec laquelle 5 références, source comprise, étayent les heures de début et de fin de l’épingle ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récenteAfficher toutes les épingles à 75 % de confiance ou plus
La première entrée est toujours la source de l’épingle. La confiance globale est une moyenne pondérée de la fermeté avec laquelle chaque référence étaye les heures de début et de fin retenues ci-dessus ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récente.
- [1]90%anthropic.com/claude-3-model-cardanthropic.com· Publié le 28 sept. 2026· Début 4 mars 2024· 48 % du score
La fiche modèle ne comporte aucune date de lancement, la date vient donc de l'article de lancement : « Présentation de la nouvelle génération de Claude, 4 mars 2024 » - « Opus et Sonnet sont désormais disponibles sur claude.ai et l'API Claude » ; l'article d'AWS du 4 mars 2024 annonce « la disponibilité de Claude 3 Sonnet d'Anthropic[3] dès aujourd'hui sur Amazon[4] Bedrock ».
- [2]75%Claude (AI) - Wikipediaen.wikipedia.org· Ajouté le 28 sept. 2026· 48 % du score
The Sonnet table lists Claude 3 Sonnet as released 4 March 2024 and discontinued; the article adds that when Anthropic[1][3] retired it in July 2025 around 200 people gathered in San Francisco for a "funeral".
- [3]95%Introducing the next generation of Claudeanthropic.com· Publié le 4 mars 2024· Début 4 mars 2024 ✓· 1 % du score
Anthropic's[1] launch post, dated "Mar 4, 2024": "Opus and Sonnet are now available to use in claude.ai and the Claude API which is now generally available in 159 countries", with Sonnet at $3/$15 per million tokens and a 200K context window, powering the free claude.ai. The model card that is the source carries no launch date, so this row dates the pin.
- [4]90%Anthropic's Claude 3 Sonnet foundation model is now available in Amazon Bedrockaws.amazon.com· Publié le 4 mars 2024· Début 4 mars 2024· 1 % du score
AWS News Blog post by Channy Yun, 04 MAR 2024: "We're also announcing the availability of Anthropic's[1][3] Claude 3 Sonnet today in Amazon Bedrock, with Claude 3 Opus and Claude 3 Haiku coming soon"; Sonnet is two times faster than Claude 2 and 2.1.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· Publié le 4 mars 2024· Début 4 mars 2024· 1 % du score
TechCrunch's same-day report: Opus and Sonnet "are available now on the web and via Anthropic's[1][3] dev console and API, Amazon's[4] Bedrock platform and Google's Vertex AI"; Claude 3 is Anthropic's first multimodal model, takes up to 20 images per request, cannot identify people and answers only from data before August 2023.
Suggérer une correction
Il manque quelque chose ou une erreur s'est glissée ? Dites-le avec vos mots : un lien qui étaye cette épingle, une autre date de début ou de fin et pourquoi, ou une information absente ou erronée. L'IA la vérifie au regard des sources de l'épingle, en cherche de meilleures et ajoute toute page qui vous donne raison. Les sources de l'épingle restent celles qui comptent le plus. L'IA regarde aussi les images : une image qui montre autre chose, ou qui le montre mal, passe en dernier ou est remplacée.