- Beginn
- 5. Aug. 202590 % SICHERHEITlaut der Quelle
Claude Opus 4.1 veröffentlicht
Automatisch aus dem Original übersetzt
Originaltitel: Claude Opus 4.1 Released
- Anthropic veröffentlichte Claude Opus 4.1 am 5. August 2025 für zahlende Claude-Nutzer, in Claude Code sowie auf seiner API, Amazon Bedrock und Google Clouds Vertex AI, zum gleichen Preis wie Opus 4[1][2]
- Es erschien am selben Tag, an dem OpenAI seine ersten offenen Reasoning-Modelle seit 2019 veröffentlichte; Anthropic erklärte, es plane „in den kommenden Wochen wesentlich größere Verbesserungen an unseren Modellen“[1][6]
- GitHub brachte es am selben Tag als öffentliche Vorschau für Enterprise- und Pro+-Pläne in Copilot[5]
- Wie Opus 4 wird es unter dem ASL-3-Sicherheitsstandard eingesetzt[3]
- Am 5. August 2026, genau ein Jahr nach dem Launch, aus der Claude API entfernt, ersetzt durch Claude Opus 4.8[4]
Bemerkenswerte Merkmale
- Ein Upgrade zu Claude Opus 4 „bei agentischen Aufgaben, realer Programmierung und Reasoning“, mit besserer eingehender Recherche und Datenanalyse, „vor allem bei der Detailverfolgung und der agentischen Suche“[1]
- 74,5 % bei SWE-bench Verified gegenüber 72,5 % bei Opus 4, und 43,3 % bei Terminal-Bench gegenüber 39,2 %[1][6]
- Weitere Werte in Anthropics Tabelle: 80,9 % bei GPQA Diamond, 82,4 % bei TAU-bench Einzelhandel, 89,5 % bei MMMLU und 78,0 % bei AIME 2025[1]
- Kundenberichte: GitHub sieht deutliche Fortschritte beim Refactoring über mehrere Dateien hinweg, Rakuten präzise Fixes in großen Codebasen, „ohne unnötige Anpassungen vorzunehmen“, und Windsurf einen Sprung um eine Standardabweichung gegenüber Opus 4[1]
- Bepreist wie Opus 4 mit 15 $ pro Million Eingabe- und 75 $ pro Million Ausgabetokens; API-ID claude-opus-4-1-20250805[1][6]
Benchmarks[1]
| Benchmark | Claude Opus 4.1 | Claude Opus 4 | Claude Sonnet 4 | OpenAI o3 | Gemini 2.5 Pro |
|---|---|---|---|---|---|
| SWE-bench Verified¹ (agentische Programmierung) | 74,5 % | 72,5 % | 72,7 % | 69,1 % | 67,2 % |
| Terminal-Bench² (agentische Terminal-Programmierung) | 43,3 % | 39,2 % | 35,5 % | 30,2 % | 25,3 % |
| GPQA Diamond (Schlussfolgern auf Graduiertenniveau) | 80,9 % | 79,6 % | 75,4 % | 83,3 % | 86,4 % |
| TAU-bench (agentische Tool-Nutzung) | Einzelhandel 82,4 %, Fluggesellschaft 56,0 % | Einzelhandel 81,4 %, Fluggesellschaft 59,6 % | Einzelhandel 80,5 %, Fluggesellschaft 60,0 % | Einzelhandel 70,4 %, Fluggesellschaft 52,0 % | — |
| MMMLU³ (mehrsprachige Fragen und Antworten) | 89,5 % | 88,8 % | 86,5 % | 88,8 % | — |
| MMMU, Validation (visuelles Schlussfolgern) | 77,1 % | 76,5 % | 74,4 % | 82,9 % | 82 % |
| AIME 2025⁴ (Mathematikwettbewerb auf Highschool-Niveau) | 78,0 % | 75,5 % | 70,5 % | 88,9 % | 88 % |
¹ Opus 4.1, Opus 4 und Sonnet 4 laufen pass@1 mit Bash-/Editor-Tools, gemittelt über 10 Durchläufe, Patches im ersten Versuch, ohne Test-Time-Compute. ² Standard-Agenten-Framework (Terminus 1), gemittelt über 5 Durchläufe. ³ Claudes Werte sind der Durchschnitt über 14 nicht-englische Sprachen. ⁴ Durchgeführt mit Nucleus Sampling, top_p 0,95.
Belege 689 % SICHERHEITGesamtvertrauen: 89%Wie gut die Quelle und die Belege des Pins seine Termine stützen.Gewichteter Durchschnitt, wie fest 6 Belege einschließlich der Quelle die Start- und Endzeiten des Pins stützen; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so vielAlle Pins mit mindestens 75 % Sicherheit anzeigen
Der erste Eintrag ist immer die Quelle des Pins. Die Gesamtsicherheit ist ein gewichteter Durchschnitt, wie fest jeder Beleg die oben verwendeten Start- und Endzeiten stützt; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so viel.
- [1]90%anthropic.com/news/claude-opus-4-1anthropic.com· Gepostet am 28. Sept. 2026· Beginn 5. Aug. 2025 ✓· 23 % der Wertung
Anthropics Beitrag ist auf „Aug 5, 2025“ datiert: „Heute veröffentlichen wir Claude[2][4] Opus 4.1 ... jetzt verfügbar für zahlende Claude-Nutzer und in Claude Code. Es ist außerdem auf unserer API, Amazon Bedrock und Google Clouds Vertex AI verfügbar“; die Claude Release Notes und GitHubs Changelog tragen dasselbe Datum.
- [2]90%Claude Platform release notes - Claude Platform Docsplatform.claude.com· Hinzugefügt am 28. Sept. 2026· 23 % der Wertung
"August 5, 2025 We've launched Claude[4] Opus 4.1, an incremental update to Claude Opus 4", which does not allow both temperature and top_p to be set; later entries record structured outputs launching for Opus 4.1 (14 November 2025) and its retirement.
- [3]90%System Card Addendum: Claude Opus 4.1anthropic.com· Hinzugefügt am 28. Sept. 2026· 23 % der Wertung
Anthropic's[1] system card addendum: "Like Claude[2][4] Opus 4, Claude Opus 4.1 is deployed under the AI Safety Level 3 (ASL-3) Standard"; it is not "notably more capable" than Opus 4 under the RSP, so new evaluations were voluntary.
- [4]90%Model deprecations - Claude Platform Docsplatform.claude.com· Hinzugefügt am 28. Sept. 2026· 23 % der Wertung
Anthropic[1][3] notified developers on 5 June 2026 that Claude[2] Opus 4.1 (claude-opus-4-1-20250805) would be retired; it was retired on 5 August 2026, one year after release, with claude-opus-4-8 as the replacement.
- [5]85%Anthropic Claude Opus 4.1 is now in public preview in GitHub Copilotgithub.blog· Veröffentlicht am 5. Aug. 2025· Beginn 5. Aug. 2025· 5 % der Wertung
GitHub's changelog, "Release August 5, 2025": Claude[2][4] Opus 4.1, "the successor to Claude Opus 4", is available in GitHub Copilot Chat for Copilot Enterprise and Pro+ plans on github.com, Visual Studio Code and GitHub Mobile.
Korrektur vorschlagen
Fehlt etwas oder stimmt etwas nicht? Sag es in deinen eigenen Worten: ein Link, der diesen Pin belegt, ein anderes Start- oder Enddatum und warum, oder eine Angabe, die fehlt oder falsch ist. Die KI prüft es an den Quellen dieses Pins, sucht nach besseren und ergänzt jede Seite, die dich bestätigt. Die eigenen Quellen des Pins zählen weiterhin am meisten. Auch Bilder sieht sich die KI an: Eines, das etwas anderes oder die Sache schlecht zeigt, wird nach hinten gestellt oder ersetzt.