- Beginn
- 4. März 202495 % SICHERHEITlaut anthropic.com
Claude 3 Sonnet veröffentlicht
Automatisch aus dem Original übersetzt
Originaltitel: Claude 3 Sonnet Released
- Anthropic kündigte die Claude-3-Familie – Haiku, Sonnet und Opus – am 4. März 2024 an, wobei Opus und Sonnet „jetzt in claude.ai und der Claude API nutzbar“ waren, was in 159 Ländern allgemein verfügbar wurde; Haiku sollte folgen[3]
- Sonnet treibt „die kostenlose Nutzung auf claude.ai“ an, während Opus Claude-Pro-Abonnenten vorbehalten blieb, und startete am selben Tag auf Amazon Bedrock sowie in privater Vorschau in Google Clouds Vertex AI Model Garden[3][4]
- Anthropic positionierte es als das Modell, das „die ideale Balance zwischen Intelligenz und Geschwindigkeit trifft – insbesondere für Unternehmens-Workloads“, und bei den meisten Workloads doppelt so schnell wie Claude 2 und Claude 2.1[3][4]
- Die Familie blieb unter Anthropics Responsible Scaling Policy auf AI Safety Level 2 (ASL-2) und lehnt harmlose Prompts nahe ihrer Leitplanken weit seltener ab als frühere Claude-Modelle[3]
- Als Anthropic Claude 3 Sonnet im Juli 2025 einstellte, versammelten sich in San Francisco rund 200 Menschen zu einer „Beerdigung“[2]
Bemerkenswerte Merkmale
- Bepreist mit 3 $ pro Million Eingabetokens und 15 $ pro Million Ausgabetokens, mit einem 200.000-Token-Kontextfenster[3]
- Die erste Claude-Generation mit Vision: Sie liest Fotos, Diagramme, Grafiken und technische Zeichnungen, bis zu 20 Bilder in einer Anfrage, wobei Anthropic sie daran hinderte, Personen zu identifizieren[1][5]
- Benchmarks aus der Model Card: 79,0 % bei MMLU (5-shot), 40,4 % bei GPQA Diamond, 92,3 % bei GSM8K und 73,0 % bei HumanEval-Python-Programmierung[1]
- Trainiert auf Hardware von Amazon Web Services und Google Cloud mit PyTorch, JAX und Triton; es antwortet anhand von Daten von vor August 2023 und kann nicht im Web suchen[1][5]
- Anthropics vorgeschlagene Einsatzgebiete: Retrieval über große Wissensdatenbanken, Produktempfehlungen und Prognosen, Codegenerierung und das Auslesen von Text aus Bildern[3]
Benchmarks[3]
| Benchmark | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| Wissen auf Bachelor-Niveau (MMLU) | 86,8 % (5-shot) | 79,0 % (5-shot) | 75,2 % (5-shot) | 86,4 % (5-shot) | 70,0 % (5-shot) | 83,7 % (5-shot) | 71,8 % (5-shot) |
| Schlussfolgern auf Graduiertenniveau (GPQA, Diamond) | 50,4 % (0-shot CoT) | 40,4 % (0-shot CoT) | 33,3 % (0-shot CoT) | 35,7 % (0-shot CoT) | 28,1 % (0-shot CoT) | — | — |
| Grundschulmathematik (GSM8K) | 95,0 % (0-shot CoT) | 92,3 % (0-shot CoT) | 88,9 % (0-shot CoT) | 92,0 % (5-shot CoT) | 57,1 % (5-shot) | 94,4 % (Maj1@32) | 86,5 % (Maj1@32) |
| Mathematisches Problemlösen (MATH) | 60,1 % (0-shot CoT) | 43,1 % (0-shot CoT) | 38,9 % (0-shot CoT) | 52,9 % (4-shot) | 34,1 % (4-shot) | 53,2 % (4-shot) | 32,6 % (4-shot) |
| Mehrsprachige Mathematik (MGSM) | 90,7 % (0-shot) | 83,5 % (0-shot) | 75,1 % (0-shot) | 74,5 % (8-shot) | — | 79,0 % (8-shot) | 63,5 % (8-shot) |
| Code (HumanEval) | 84,9 % (0-shot) | 73,0 % (0-shot) | 75,9 % (0-shot) | 67,0 % (0-shot) | 48,1 % (0-shot) | 74,4 % (0-shot) | 67,7 % (0-shot) |
| Schlussfolgern über Text (DROP, F1-Wert) | 83,1 (3-shot) | 78,9 (3-shot) | 78,4 (3-shot) | 80,9 (3-shot) | 64,1 (3-shot) | 82,4 (variable Shot-Anzahl) | 74,1 (variable Shot-Anzahl) |
| Gemischte Bewertungen (BIG-Bench-Hard) | 86,8 % (3-shot CoT) | 82,9 % (3-shot CoT) | 73,7 % (3-shot CoT) | 83,1 % (3-shot CoT) | 66,6 % (3-shot CoT) | 83,6 % (3-shot CoT) | 75,0 % (3-shot CoT) |
| Wissensfragen (ARC-Challenge) | 96,4 % (25-shot) | 93,2 % (25-shot) | 89,2 % (25-shot) | 96,3 % (25-shot) | 85,2 % (25-shot) | — | — |
| Allgemeinwissen (HellaSwag) | 95,4 % (10-shot) | 89,0 % (10-shot) | 85,9 % (10-shot) | 95,3 % (10-shot) | 85,5 % (10-shot) | 87,8 % (10-shot) | 84,7 % (10-shot) |
Belege 583 % SICHERHEITGesamtvertrauen: 83%Wie gut die Quelle und die Belege des Pins seine Termine stützen.Gewichteter Durchschnitt, wie fest 5 Belege einschließlich der Quelle die Start- und Endzeiten des Pins stützen; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so vielAlle Pins mit mindestens 75 % Sicherheit anzeigen
Der erste Eintrag ist immer die Quelle des Pins. Die Gesamtsicherheit ist ein gewichteter Durchschnitt, wie fest jeder Beleg die oben verwendeten Start- und Endzeiten stützt; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so viel.
- [1]90%anthropic.com/claude-3-model-cardanthropic.com· Gepostet am 28. Sept. 2026· Beginn 4. März 2024· 48 % der Wertung
Die Model Card trägt kein Launch-Datum, daher stammt das Datum vom Launch-Beitrag: „Introducing the next generation of Claude, Mar 4, 2024“ – „Opus und Sonnet sind jetzt in claude.ai und der Claude API nutzbar“; AWS’ Beitrag vom 04 MAR 2024 kündigt „die Verfügbarkeit von Anthropics Claude 3 Sonnet heute in Amazon[4] Bedrock“ an.
- [2]75%Claude (AI) - Wikipediaen.wikipedia.org· Hinzugefügt am 28. Sept. 2026· 48 % der Wertung
The Sonnet table lists Claude 3 Sonnet as released 4 March 2024 and discontinued; the article adds that when Anthropic[1][3] retired it in July 2025 around 200 people gathered in San Francisco for a "funeral".
- [3]95%Introducing the next generation of Claudeanthropic.com· Veröffentlicht am 4. März 2024· Beginn 4. März 2024 ✓· 1 % der Wertung
Anthropic's[1] launch post, dated "Mar 4, 2024": "Opus and Sonnet are now available to use in claude.ai and the Claude API which is now generally available in 159 countries", with Sonnet at $3/$15 per million tokens and a 200K context window, powering the free claude.ai. The model card that is the source carries no launch date, so this row dates the pin.
- [4]90%Anthropic's Claude 3 Sonnet foundation model is now available in Amazon Bedrockaws.amazon.com· Veröffentlicht am 4. März 2024· Beginn 4. März 2024· 1 % der Wertung
AWS News Blog post by Channy Yun, 04 MAR 2024: "We're also announcing the availability of Anthropic's[1][3] Claude 3 Sonnet today in Amazon Bedrock, with Claude 3 Opus and Claude 3 Haiku coming soon"; Sonnet is two times faster than Claude 2 and 2.1.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· Veröffentlicht am 4. März 2024· Beginn 4. März 2024· 1 % der Wertung
TechCrunch's same-day report: Opus and Sonnet "are available now on the web and via Anthropic's[1][3] dev console and API, Amazon's[4] Bedrock platform and Google's Vertex AI"; Claude 3 is Anthropic's first multimodal model, takes up to 20 images per request, cannot identify people and answers only from data before August 2023.
Korrektur vorschlagen
Fehlt etwas oder stimmt etwas nicht? Sag es in deinen eigenen Worten: ein Link, der diesen Pin belegt, ein anderes Start- oder Enddatum und warum, oder eine Angabe, die fehlt oder falsch ist. Die KI prüft es an den Quellen dieses Pins, sucht nach besseren und ergänzt jede Seite, die dich bestätigt. Die eigenen Quellen des Pins zählen weiterhin am meisten. Auch Bilder sieht sich die KI an: Eines, das etwas anderes oder die Sache schlecht zeigt, wird nach hinten gestellt oder ersetzt.