- Inizio
- 4 mar 2024AFFIDABILITÀ 95%da anthropic.com
Rilasciato Claude 3 Sonnet
Tradotto automaticamente dall’originale
Titolo originale: Claude 3 Sonnet Released
- Anthropic ha annunciato la famiglia Claude 3 - Haiku, Sonnet e Opus - il 4 marzo 2024, con Opus e Sonnet «ora disponibili su claude.ai e nell'API di Claude», diventata disponibile in via generale in 159 paesi; Haiku sarebbe seguito[3]
- Sonnet alimenta «l'esperienza gratuita su claude.ai», con Opus riservato agli abbonati Claude Pro, ed è stato lanciato lo stesso giorno su Amazon Bedrock e in anteprima privata su Vertex AI Model Garden di Google Cloud[3][4]
- Anthropic lo ha proposto come il modello che «raggiunge l'equilibrio ideale tra intelligenza e velocità, in particolare per i carichi di lavoro aziendali» e, per la maggior parte dei carichi di lavoro, veloce il doppio di Claude 2 e Claude 2.1[3][4]
- La famiglia è rimasta all'AI Safety Level 2 (ASL-2) secondo la Responsible Scaling Policy di Anthropic, e rifiuta i prompt innocui vicini ai suoi limiti molto meno spesso dei precedenti modelli Claude[3]
- Quando Anthropic ha ritirato Claude 3 Sonnet nel luglio 2025, circa 200 persone si sono riunite a San Francisco per un «funerale»[2]
Caratteristiche principali
- Al prezzo di 3 $ per milione di token in input e 15 $ per milione di token in output, con una finestra di contesto da 200K token[3]
- La prima generazione di Claude con visione: legge foto, grafici, diagrammi e schemi tecnici, fino a 20 immagini in una richiesta, anche se Anthropic gli ha impedito di identificare le persone[1][5]
- Benchmark della model card: 79,0% su MMLU (5-shot), 40,4% su GPQA Diamond, 92,3% su GSM8K e 73,0% su HumanEval per la programmazione in Python[1]
- Addestrato su hardware di Amazon Web Services e Google Cloud con PyTorch, JAX e Triton; risponde in base a dati precedenti ad agosto 2023 e non può cercare sul web[1][5]
- Usi suggeriti da Anthropic: recupero su grandi basi di conoscenza, raccomandazioni di prodotto e previsioni, generazione di codice ed estrazione di testo da immagini[3]
Benchmark[3]
| Benchmark | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| Conoscenze di livello universitario (MMLU) | 86.8% (5-shot) | 79.0% (5-shot) | 75.2% (5-shot) | 86.4% (5-shot) | 70.0% (5-shot) | 83.7% (5-shot) | 71.8% (5-shot) |
| Ragionamento di livello post-laurea (GPQA, Diamond) | 50.4% (0-shot CoT) | 40.4% (0-shot CoT) | 33.3% (0-shot CoT) | 35.7% (0-shot CoT) | 28.1% (0-shot CoT) | — | — |
| Matematica delle scuole elementari (GSM8K) | 95.0% (0-shot CoT) | 92.3% (0-shot CoT) | 88.9% (0-shot CoT) | 92.0% (5-shot CoT) | 57.1% (5-shot) | 94.4% (Maj1@32) | 86.5% (Maj1@32) |
| Risoluzione di problemi matematici (MATH) | 60.1% (0-shot CoT) | 43.1% (0-shot CoT) | 38.9% (0-shot CoT) | 52.9% (4-shot) | 34.1% (4-shot) | 53.2% (4-shot) | 32.6% (4-shot) |
| Matematica multilingue (MGSM) | 90.7% (0-shot) | 83.5% (0-shot) | 75.1% (0-shot) | 74.5% (8-shot) | — | 79.0% (8-shot) | 63.5% (8-shot) |
| Codice (HumanEval) | 84.9% (0-shot) | 73.0% (0-shot) | 75.9% (0-shot) | 67.0% (0-shot) | 48.1% (0-shot) | 74.4% (0-shot) | 67.7% (0-shot) |
| Ragionamento sul testo (DROP, punteggio F1) | 83.1 (3-shot) | 78.9 (3-shot) | 78.4 (3-shot) | 80.9 (3-shot) | 64.1 (3-shot) | 82.4 (shot variabili) | 74.1 (shot variabili) |
| Valutazioni miste (BIG-Bench-Hard) | 86.8% (3-shot CoT) | 82.9% (3-shot CoT) | 73.7% (3-shot CoT) | 83.1% (3-shot CoT) | 66.6% (3-shot CoT) | 83.6% (3-shot CoT) | 75.0% (3-shot CoT) |
| Domande e risposte di conoscenza (ARC-Challenge) | 96.4% (25-shot) | 93.2% (25-shot) | 89.2% (25-shot) | 96.3% (25-shot) | 85.2% (25-shot) | — | — |
| Conoscenza comune (HellaSwag) | 95.4% (10-shot) | 89.0% (10-shot) | 85.9% (10-shot) | 95.3% (10-shot) | 85.5% (10-shot) | 87.8% (10-shot) | 84.7% (10-shot) |
Fonti 5AFFIDABILITÀ 83%Affidabilità complessiva: 83%Quanto la fonte e le altre fonti del pin ne confermano le date.Media ponderata di quanto 5 fonti, compresa quella principale, confermano gli orari di inizio e fine del pin; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recenteMostra tutti i pin con affidabilità pari o superiore al 75%
La prima voce è sempre la fonte del pin. L’affidabilità complessiva è una media ponderata di quanto ogni fonte conferma gli orari di inizio e fine indicati sopra; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recente.
- [1]90%anthropic.com/claude-3-model-cardanthropic.com· Postato il 28 set 2026· Inizio 4 mar 2024· 48% del punteggio
La model card non riporta una data di lancio, quindi la data è quella del post di lancio: «Introducing the next generation of Claude, Mar 4, 2024» - «Opus and Sonnet are now available to use in claude.ai and the Claude API»; il post di AWS del 04 MAR 2024 annuncia «la disponibilità oggi di Claude 3 Sonnet di Anthropic[3] su Amazon[4] Bedrock».
- [2]75%Claude (AI) - Wikipediaen.wikipedia.org· Aggiunto il 28 set 2026· 48% del punteggio
The Sonnet table lists Claude 3 Sonnet as released 4 March 2024 and discontinued; the article adds that when Anthropic[1][3] retired it in July 2025 around 200 people gathered in San Francisco for a "funeral".
- [3]95%Introducing the next generation of Claudeanthropic.com· Pubblicato il 4 mar 2024· Inizio 4 mar 2024 ✓· 1% del punteggio
Anthropic's[1] launch post, dated "Mar 4, 2024": "Opus and Sonnet are now available to use in claude.ai and the Claude API which is now generally available in 159 countries", with Sonnet at $3/$15 per million tokens and a 200K context window, powering the free claude.ai. The model card that is the source carries no launch date, so this row dates the pin.
- [4]90%Anthropic's Claude 3 Sonnet foundation model is now available in Amazon Bedrockaws.amazon.com· Pubblicato il 4 mar 2024· Inizio 4 mar 2024· 1% del punteggio
AWS News Blog post by Channy Yun, 04 MAR 2024: "We're also announcing the availability of Anthropic's[1][3] Claude 3 Sonnet today in Amazon Bedrock, with Claude 3 Opus and Claude 3 Haiku coming soon"; Sonnet is two times faster than Claude 2 and 2.1.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· Pubblicato il 4 mar 2024· Inizio 4 mar 2024· 1% del punteggio
TechCrunch's same-day report: Opus and Sonnet "are available now on the web and via Anthropic's[1][3] dev console and API, Amazon's[4] Bedrock platform and Google's Vertex AI"; Claude 3 is Anthropic's first multimodal model, takes up to 20 images per request, cannot identify people and answers only from data before August 2023.
Suggerisci una correzione
Manca qualcosa o c’è un errore? Dillo con parole tue: un link che conferma questo pin, una data di inizio o fine diversa e perché, o un fatto che manca o è sbagliato. L’IA lo confronta con le fonti del pin, ne cerca di migliori e aggiunge qualsiasi pagina ti dia ragione. Le fonti del pin contano comunque di più. Anche un’immagine che mostra altro, o lo mostra male, viene esaminata e spostata in basso o sostituita.