- Inicio
- 4 mar 202495% DE CONFIANZAsegún anthropic.com
Anthropic lanza Claude 3 Sonnet
Traducido automáticamente del original
Título original: Claude 3 Sonnet Released
- Anthropic anunció la familia Claude 3 - Haiku, Sonnet y Opus - el 4 de marzo de 2024, con Opus y Sonnet «ya disponibles para usarse en claude.ai y en la API de Claude», que pasó a disponibilidad general en 159 países; Haiku llegaría después[3]
- Sonnet impulsa «la experiencia gratuita en claude.ai», con Opus reservado para los suscriptores de Claude Pro, y se lanzó ese mismo día en Amazon Bedrock y en vista previa privada en Vertex AI Model Garden de Google Cloud[3][4]
- Anthropic lo presentó como el modelo que «logra el equilibrio ideal entre inteligencia y velocidad, particularmente para las cargas de trabajo empresariales», y que en la mayoría de las cargas de trabajo es el doble de rápido que Claude 2 y Claude 2.1[3][4]
- La familia se mantuvo en el Nivel de Seguridad de IA 2 (ASL-2) bajo la Política de Escalado Responsable de Anthropic, y rechaza las solicitudes inocuas cercanas a sus límites con mucho menos frecuencia que los modelos anteriores de Claude[3]
- Cuando Anthropic retiró Claude 3 Sonnet en julio de 2025, unas 200 personas se reunieron en San Francisco para un «funeral»[2]
Características destacadas
- Con un precio de $3 por millón de tokens de entrada y $15 por millón de tokens de salida, con una ventana de contexto de 200K tokens[3]
- La primera generación de Claude con visión: lee fotos, gráficos, diagramas y esquemas técnicos, hasta 20 imágenes en una sola solicitud, aunque Anthropic le impidió identificar a personas[1][5]
- Puntuaciones de la ficha del modelo: 79.0% en MMLU (5-shot), 40.4% en GPQA Diamond, 92.3% en GSM8K y 73.0% en codificación en Python de HumanEval[1]
- Entrenado con hardware de Amazon Web Services y Google Cloud usando PyTorch, JAX y Triton; responde con datos anteriores a agosto de 2023 y no puede buscar en la web[1][5]
- Usos sugeridos por Anthropic: recuperación en grandes bases de conocimiento, recomendaciones de productos y pronósticos, generación de código y extracción de texto de imágenes[3]
Pruebas de referencia[3]
| Prueba de referencia | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| Conocimiento de nivel universitario (MMLU) | 86.8% (5-shot) | 79.0% (5-shot) | 75.2% (5-shot) | 86.4% (5-shot) | 70.0% (5-shot) | 83.7% (5-shot) | 71.8% (5-shot) |
| Razonamiento de nivel de posgrado (GPQA, Diamond) | 50.4% (0-shot CoT) | 40.4% (0-shot CoT) | 33.3% (0-shot CoT) | 35.7% (0-shot CoT) | 28.1% (0-shot CoT) | — | — |
| Matemáticas de escuela primaria (GSM8K) | 95.0% (0-shot CoT) | 92.3% (0-shot CoT) | 88.9% (0-shot CoT) | 92.0% (5-shot CoT) | 57.1% (5-shot) | 94.4% (Maj1@32) | 86.5% (Maj1@32) |
| Resolución de problemas matemáticos (MATH) | 60.1% (0-shot CoT) | 43.1% (0-shot CoT) | 38.9% (0-shot CoT) | 52.9% (4-shot) | 34.1% (4-shot) | 53.2% (4-shot) | 32.6% (4-shot) |
| Matemáticas multilingües (MGSM) | 90.7% (0-shot) | 83.5% (0-shot) | 75.1% (0-shot) | 74.5% (8-shot) | — | 79.0% (8-shot) | 63.5% (8-shot) |
| Código (HumanEval) | 84.9% (0-shot) | 73.0% (0-shot) | 75.9% (0-shot) | 67.0% (0-shot) | 48.1% (0-shot) | 74.4% (0-shot) | 67.7% (0-shot) |
| Razonamiento sobre texto (DROP, puntuación F1) | 83.1 (3-shot) | 78.9 (3-shot) | 78.4 (3-shot) | 80.9 (3-shot) | 64.1 (3-shot) | 82.4 (variable shots) | 74.1 (variable shots) |
| Evaluaciones mixtas (BIG-Bench-Hard) | 86.8% (3-shot CoT) | 82.9% (3-shot CoT) | 73.7% (3-shot CoT) | 83.1% (3-shot CoT) | 66.6% (3-shot CoT) | 83.6% (3-shot CoT) | 75.0% (3-shot CoT) |
| Preguntas y respuestas de conocimiento (ARC-Challenge) | 96.4% (25-shot) | 93.2% (25-shot) | 89.2% (25-shot) | 96.3% (25-shot) | 85.2% (25-shot) | — | — |
| Conocimiento común (HellaSwag) | 95.4% (10-shot) | 89.0% (10-shot) | 85.9% (10-shot) | 95.3% (10-shot) | 85.5% (10-shot) | 87.8% (10-shot) | 84.7% (10-shot) |
Referencias 583% DE CONFIANZAConfianza general: 83%Hasta qué punto la fuente y las referencias del pin respaldan sus fechas.Media ponderada de la firmeza con la que 5 referencias, incluida la fuente, respaldan las horas de inicio y fin del pin; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más recienteMostrar todos los pines con un 75% de confianza o más
La primera entrada es siempre la fuente del pin. La confianza global es una media ponderada de la firmeza con la que cada referencia respalda las horas de inicio y fin usadas arriba; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más reciente.
- [1]90%anthropic.com/claude-3-model-cardanthropic.com· Publicado el 28 sept 2026· Empieza 4 mar 2024· 48% de la puntuación
La ficha del modelo no lleva fecha de lanzamiento, así que la fecha es la de la publicación del lanzamiento: «Presentamos la próxima generación de Claude, 4 de marzo de 2024» - «Opus y Sonnet ya están disponibles para usarse en claude.ai y en la API de Claude»; la publicación de AWS del 04 DE MAR DE 2024 anuncia «la disponibilidad de Claude 3 Sonnet de Anthropic[3] hoy en Amazon[4] Bedrock».
- [2]75%Claude (AI) - Wikipediaen.wikipedia.org· Añadido el 28 sept 2026· 48% de la puntuación
The Sonnet table lists Claude 3 Sonnet as released 4 March 2024 and discontinued; the article adds that when Anthropic[1][3] retired it in July 2025 around 200 people gathered in San Francisco for a "funeral".
- [3]95%Introducing the next generation of Claudeanthropic.com· Publicado el 4 mar 2024· Empieza 4 mar 2024 ✓· 1% de la puntuación
Anthropic's[1] launch post, dated "Mar 4, 2024": "Opus and Sonnet are now available to use in claude.ai and the Claude API which is now generally available in 159 countries", with Sonnet at $3/$15 per million tokens and a 200K context window, powering the free claude.ai. The model card that is the source carries no launch date, so this row dates the pin.
- [4]90%Anthropic's Claude 3 Sonnet foundation model is now available in Amazon Bedrockaws.amazon.com· Publicado el 4 mar 2024· Empieza 4 mar 2024· 1% de la puntuación
AWS News Blog post by Channy Yun, 04 MAR 2024: "We're also announcing the availability of Anthropic's[1][3] Claude 3 Sonnet today in Amazon Bedrock, with Claude 3 Opus and Claude 3 Haiku coming soon"; Sonnet is two times faster than Claude 2 and 2.1.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· Publicado el 4 mar 2024· Empieza 4 mar 2024· 1% de la puntuación
TechCrunch's same-day report: Opus and Sonnet "are available now on the web and via Anthropic's[1][3] dev console and API, Amazon's[4] Bedrock platform and Google's Vertex AI"; Claude 3 is Anthropic's first multimodal model, takes up to 20 images per request, cannot identify people and answers only from data before August 2023.
Sugerir una corrección
¿Falta algo o hay un error? Dilo con tus palabras: un enlace que respalde este pin, otra fecha de inicio o fin y por qué, o un dato que falta o está mal. La IA lo contrasta con las fuentes del pin, busca otras mejores y añade cualquier página que te dé la razón. Las fuentes del propio pin siguen contando más. La IA también mira las imágenes: una que muestra otra cosa, o la muestra mal, pasa al final o se sustituye.