- Início
- 4 de mar. de 202495% DE CONFIANÇAde anthropic.com
Claude 3 Sonnet é lançado
Traduzido automaticamente do original
Título original: Claude 3 Sonnet Released
- A Anthropic anunciou a família Claude 3 - Haiku, Sonnet e Opus - em 4 de março de 2024, com Opus e Sonnet “agora disponíveis para uso no claude.ai e na API do Claude”, que passou a ter disponibilidade geral em 159 países; o Haiku viria depois[3]
- O Sonnet move “a experiência gratuita no claude.ai”, com o Opus reservado aos assinantes do Claude Pro, e foi lançado no mesmo dia no Amazon Bedrock e em prévia privada no Vertex AI Model Garden do Google Cloud[3][4]
- A Anthropic o apresentou como o modelo que “alcança o equilíbrio ideal entre inteligência e velocidade - particularmente para cargas de trabalho corporativas” e, na maioria das cargas, duas vezes mais rápido que o Claude 2 e o Claude 2.1[3][4]
- A família continuou no AI Safety Level 2 (ASL-2) da Responsible Scaling Policy da Anthropic e recusa prompts inofensivos perto de seus limites de segurança com muito menos frequência que os modelos Claude anteriores[3]
- Quando a Anthropic aposentou o Claude 3 Sonnet, em julho de 2025, cerca de 200 pessoas se reuniram em San Francisco para um “funeral”[2]
Destaques
- Preço de US$ 3 por milhão de tokens de entrada e US$ 15 por milhão de tokens de saída, com janela de contexto de 200 mil tokens[3]
- A primeira geração do Claude com visão: lê fotos, gráficos, diagramas e esquemas técnicos, até 20 imagens em uma única requisição, embora a Anthropic o tenha impedido de identificar pessoas[1][5]
- Benchmarks do model card: 79,0% no MMLU (5-shot), 40,4% no GPQA Diamond, 92,3% no GSM8K e 73,0% no HumanEval, de programação em Python[1]
- Treinado em hardware da Amazon Web Services e do Google Cloud com PyTorch, JAX e Triton; responde com base em dados anteriores a agosto de 2023 e não pode pesquisar na web[1][5]
- Usos sugeridos pela Anthropic: recuperação em grandes bases de conhecimento, recomendações de produtos e previsões, geração de código e extração de texto de imagens[3]
Benchmarks[3]
| Benchmark | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| Conhecimento de nível de graduação (MMLU) | 86,8% (5-shot) | 79,0% (5-shot) | 75,2% (5-shot) | 86,4% (5-shot) | 70,0% (5-shot) | 83,7% (5-shot) | 71,8% (5-shot) |
| Raciocínio de nível de pós-graduação (GPQA, Diamond) | 50,4% (0-shot CoT) | 40,4% (0-shot CoT) | 33,3% (0-shot CoT) | 35,7% (0-shot CoT) | 28,1% (0-shot CoT) | — | — |
| Matemática do ensino fundamental (GSM8K) | 95,0% (0-shot CoT) | 92,3% (0-shot CoT) | 88,9% (0-shot CoT) | 92,0% (5-shot CoT) | 57,1% (5-shot) | 94,4% (Maj1@32) | 86,5% (Maj1@32) |
| Resolução de problemas matemáticos (MATH) | 60,1% (0-shot CoT) | 43,1% (0-shot CoT) | 38,9% (0-shot CoT) | 52,9% (4-shot) | 34,1% (4-shot) | 53,2% (4-shot) | 32,6% (4-shot) |
| Matemática multilíngue (MGSM) | 90,7% (0-shot) | 83,5% (0-shot) | 75,1% (0-shot) | 74,5% (8-shot) | — | 79,0% (8-shot) | 63,5% (8-shot) |
| Código (HumanEval) | 84,9% (0-shot) | 73,0% (0-shot) | 75,9% (0-shot) | 67,0% (0-shot) | 48,1% (0-shot) | 74,4% (0-shot) | 67,7% (0-shot) |
| Raciocínio sobre texto (DROP, F1 score) | 83,1 (3-shot) | 78,9 (3-shot) | 78,4 (3-shot) | 80,9 (3-shot) | 64,1 (3-shot) | 82,4 (shots variáveis) | 74,1 (shots variáveis) |
| Avaliações mistas (BIG-Bench-Hard) | 86,8% (3-shot CoT) | 82,9% (3-shot CoT) | 73,7% (3-shot CoT) | 83,1% (3-shot CoT) | 66,6% (3-shot CoT) | 83,6% (3-shot CoT) | 75,0% (3-shot CoT) |
| Perguntas e respostas de conhecimento (ARC-Challenge) | 96,4% (25-shot) | 93,2% (25-shot) | 89,2% (25-shot) | 96,3% (25-shot) | 85,2% (25-shot) | — | — |
| Conhecimento geral (HellaSwag) | 95,4% (10-shot) | 89,0% (10-shot) | 85,9% (10-shot) | 95,3% (10-shot) | 85,5% (10-shot) | 87,8% (10-shot) | 84,7% (10-shot) |
Referências 583% DE CONFIANÇAConfiança geral: 83%Quanto a fonte e as referências do pin sustentam suas datas.Média ponderada de quanto 5 referências, incluindo a fonte, sustentam os horários de início e fim do pin; uma referência conta metade a cada 180 dias a mais em relação à mais recenteMostrar todos os pins com confiança de 75% ou mais
A primeira entrada é sempre a fonte do pin. A confiança geral é uma média ponderada de quanto cada referência sustenta os horários de início e fim usados acima; uma referência conta metade a cada 180 dias a mais em relação à mais recente.
- [1]90%anthropic.com/claude-3-model-cardanthropic.com· Postado em 28 de set. de 2026· Início 4 de mar. de 2024· 48% da pontuação
O model card não traz data de lançamento, então a data é a do texto de lançamento: “Introducing the next generation of Claude, Mar 4, 2024” (“Apresentando a próxima geração do Claude, 4 de mar. de 2024”) - “Opus e Sonnet agora estão disponíveis para uso no claude.ai e na API do Claude”; o texto da AWS de 04 MAR 2024 anuncia “a disponibilidade do Claude 3 Sonnet da Anthropic[3] hoje no Amazon[4] Bedrock”.
- [2]75%Claude (AI) - Wikipediaen.wikipedia.org· Adicionado em 28 de set. de 2026· 48% da pontuação
The Sonnet table lists Claude 3 Sonnet as released 4 March 2024 and discontinued; the article adds that when Anthropic[1][3] retired it in July 2025 around 200 people gathered in San Francisco for a "funeral".
- [3]95%Introducing the next generation of Claudeanthropic.com· Publicado em 4 de mar. de 2024· Início 4 de mar. de 2024 ✓· 1% da pontuação
Anthropic's[1] launch post, dated "Mar 4, 2024": "Opus and Sonnet are now available to use in claude.ai and the Claude API which is now generally available in 159 countries", with Sonnet at $3/$15 per million tokens and a 200K context window, powering the free claude.ai. The model card that is the source carries no launch date, so this row dates the pin.
- [4]90%Anthropic's Claude 3 Sonnet foundation model is now available in Amazon Bedrockaws.amazon.com· Publicado em 4 de mar. de 2024· Início 4 de mar. de 2024· 1% da pontuação
AWS News Blog post by Channy Yun, 04 MAR 2024: "We're also announcing the availability of Anthropic's[1][3] Claude 3 Sonnet today in Amazon Bedrock, with Claude 3 Opus and Claude 3 Haiku coming soon"; Sonnet is two times faster than Claude 2 and 2.1.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· Publicado em 4 de mar. de 2024· Início 4 de mar. de 2024· 1% da pontuação
TechCrunch's same-day report: Opus and Sonnet "are available now on the web and via Anthropic's[1][3] dev console and API, Amazon's[4] Bedrock platform and Google's Vertex AI"; Claude 3 is Anthropic's first multimodal model, takes up to 20 images per request, cannot identify people and answers only from data before August 2023.
Sugerir uma correção
Falta algo ou há um erro? Diga com suas palavras: um link que sustente este pin, uma data de início ou fim diferente e por quê, ou um fato que falta ou está errado. A IA confere isso com as fontes do pin, procura outras melhores e adiciona qualquer página que dê razão a você. As fontes do próprio pin continuam contando mais. Uma imagem que mostra outra coisa, ou mostra mal, também é analisada e rebaixada ou substituída.