- Inizio
- 5 ago 2025AFFIDABILITÀ 90%da la fonte
Rilasciato Claude Opus 4.1
Tradotto automaticamente dall’originale
Titolo originale: Claude Opus 4.1 Released
- Anthropic ha rilasciato Claude Opus 4.1 il 5 agosto 2025 agli utenti Claude a pagamento, in Claude Code e sulla sua API, su Amazon Bedrock e su Vertex AI di Google Cloud, allo stesso prezzo di Opus 4[1][2]
- È uscito lo stesso giorno in cui OpenAI ha rilasciato i suoi primi modelli di ragionamento a pesi aperti dal 2019; Anthropic ha detto di prevedere «miglioramenti sostanzialmente più grandi ai nostri modelli nelle prossime settimane»[1][6]
- GitHub lo ha inserito in Copilot lo stesso giorno come anteprima pubblica per i piani Enterprise e Pro+[5]
- Come Opus 4 è distribuito con lo standard di sicurezza ASL-3[3]
- Ritirato dall'API di Claude il 5 agosto 2026, esattamente un anno dopo il lancio, sostituito da Claude Opus 4.8[4]
Caratteristiche principali
- Un aggiornamento di Claude Opus 4 «nei compiti con agenti, nella programmazione reale e nel ragionamento», con ricerca approfondita e analisi dei dati migliori, «in particolare per il tracciamento dei dettagli e la ricerca con agenti»[1]
- 74,5% su SWE-bench Verified contro il 72,5% di Opus 4, e 43,3% su Terminal-Bench contro il 39,2%[1][6]
- Altri punteggi nella tabella di Anthropic: 80,9% su GPQA Diamond, 82,4% su TAU-bench retail, 89,5% su MMMLU e 78,0% su AIME 2025[1]
- Resoconti dei clienti: GitHub vede miglioramenti notevoli nel refactoring su più file, Rakuten correzioni precise in grandi basi di codice «senza apportare modifiche non necessarie» e Windsurf un salto di una deviazione standard rispetto a Opus 4[1]
- Prezzo come Opus 4, 15 $ per milione di token in input e 75 $ per milione in output; ID API claude-opus-4-1-20250805[1][6]
Benchmark[1]
| Benchmark | Claude Opus 4.1 | Claude Opus 4 | Claude Sonnet 4 | OpenAI o3 | Gemini 2.5 Pro |
|---|---|---|---|---|---|
| SWE-bench Verified¹ (programmazione con agenti) | 74.5% | 72.5% | 72.7% | 69.1% | 67.2% |
| Terminal-Bench² (programmazione da terminale con agenti) | 43.3% | 39.2% | 35.5% | 30.2% | 25.3% |
| GPQA Diamond (ragionamento di livello post-laurea) | 80.9% | 79.6% | 75.4% | 83.3% | 86.4% |
| TAU-bench (uso di strumenti con agenti) | Retail 82.4%, Compagnie aeree 56.0% | Retail 81.4%, Compagnie aeree 59.6% | Retail 80.5%, Compagnie aeree 60.0% | Retail 70.4%, Compagnie aeree 52.0% | — |
| MMMLU³ (domande e risposte multilingue) | 89.5% | 88.8% | 86.5% | 88.8% | — |
| MMMU, validazione (ragionamento visivo) | 77.1% | 76.5% | 74.4% | 82.9% | 82% |
| AIME 2025⁴ (competizione di matematica delle superiori) | 78.0% | 75.5% | 70.5% | 88.9% | 88% |
¹ Opus 4.1, Opus 4 e Sonnet 4 eseguiti pass@1 con strumenti bash/editor, in media su 10 prove, patch a tentativo singolo, senza calcolo al momento del test. ² Framework di agenti predefinito (Terminus 1), in media su 5 prove. ³ I punteggi di Claude sono la media su 14 lingue diverse dall'inglese. ⁴ Eseguito con nucleus sampling, top_p 0.95.
Fonti 6AFFIDABILITÀ 89%Affidabilità complessiva: 89%Quanto la fonte e le altre fonti del pin ne confermano le date.Media ponderata di quanto 6 fonti, compresa quella principale, confermano gli orari di inizio e fine del pin; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recenteMostra tutti i pin con affidabilità pari o superiore al 75%
La prima voce è sempre la fonte del pin. L’affidabilità complessiva è una media ponderata di quanto ogni fonte conferma gli orari di inizio e fine indicati sopra; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recente.
- [1]90%anthropic.com/news/claude-opus-4-1anthropic.com· Postato il 28 set 2026· Inizio 5 ago 2025 ✓· 23% del punteggio
Il post di Anthropic[3] è datato «Aug 5, 2025»: «Today we're releasing Claude[2][4] Opus 4.1 ... now available to paid Claude users and in Claude Code. It's also on our API, Amazon Bedrock, and Google Cloud's Vertex AI»; le note di rilascio di Claude e il changelog di GitHub[5] riportano la stessa data.
- [2]90%Claude Platform release notes - Claude Platform Docsplatform.claude.com· Aggiunto il 28 set 2026· 23% del punteggio
"August 5, 2025 We've launched Claude[4] Opus 4.1, an incremental update to Claude Opus 4", which does not allow both temperature and top_p to be set; later entries record structured outputs launching for Opus 4.1 (14 November 2025) and its retirement.
- [3]90%System Card Addendum: Claude Opus 4.1anthropic.com· Aggiunto il 28 set 2026· 23% del punteggio
Anthropic's[1] system card addendum: "Like Claude[2][4] Opus 4, Claude Opus 4.1 is deployed under the AI Safety Level 3 (ASL-3) Standard"; it is not "notably more capable" than Opus 4 under the RSP, so new evaluations were voluntary.
- [4]90%Model deprecations - Claude Platform Docsplatform.claude.com· Aggiunto il 28 set 2026· 23% del punteggio
Anthropic[1][3] notified developers on 5 June 2026 that Claude[2] Opus 4.1 (claude-opus-4-1-20250805) would be retired; it was retired on 5 August 2026, one year after release, with claude-opus-4-8 as the replacement.
- [5]85%Anthropic Claude Opus 4.1 is now in public preview in GitHub Copilotgithub.blog· Pubblicato il 5 ago 2025· Inizio 5 ago 2025· 5% del punteggio
GitHub's changelog, "Release August 5, 2025": Claude[2][4] Opus 4.1, "the successor to Claude Opus 4", is available in GitHub Copilot Chat for Copilot Enterprise and Pro+ plans on github.com, Visual Studio Code and GitHub Mobile.
Suggerisci una correzione
Manca qualcosa o c’è un errore? Dillo con parole tue: un link che conferma questo pin, una data di inizio o fine diversa e perché, o un fatto che manca o è sbagliato. L’IA lo confronta con le fonti del pin, ne cerca di migliori e aggiunge qualsiasi pagina ti dia ragione. Le fonti del pin contano comunque di più. Anche un’immagine che mostra altro, o lo mostra male, viene esaminata e spostata in basso o sostituita.