- Inicio
- 4 mar 202490% DE CONFIANZAsegún la fuente
Anthropic lanza Claude 3 Opus
Traducido automáticamente del original
Título original: Claude 3 Opus Released
- Anthropic anunció la familia Claude 3 - Haiku, Sonnet y Opus, «en orden ascendente de capacidad» - el 4 de marzo de 2024, con Opus y Sonnet disponibles ese mismo día en claude.ai y en la API de Claude, ahora disponible con carácter general en 159 países[1][4]
- En claude.ai, Opus se ofreció a los suscriptores de Claude Pro mientras que Sonnet impulsaba la experiencia gratuita; Sonnet llegó ese mismo día a Amazon Bedrock y a una vista previa privada de Google Cloud Vertex AI, «con Opus y Haiku disponibles próximamente en ambos»[1]
- Anthropic mantuvo el modelo en el Nivel de Seguridad de IA 2 (ASL-2) después de que las pruebas de equipo rojo detectaran un «potencial insignificante de riesgo catastrófico en este momento»[1]
- CNBC señala que entre los inversores de Anthropic figuran Google, Salesforce y Amazon, tras acuerdos de financiación por un total de unos $7.3 mil millones durante el año anterior[4]
- Claude 3 Opus quedó obsoleto el 30 de junio de 2025 y se retiró de la API de Claude el 5 de enero de 2026, sustituido por Claude Opus 4.8[3]
Características destacadas
- Claude 3 Opus es «nuestro modelo más inteligente, con un rendimiento líder en el mercado en tareas muy complejas», con un precio de $15 por millón de tokens de entrada y $75 por millón de tokens de salida[1][5]
- Puntuaciones que reporta Anthropic: 86.8% en MMLU, 50.4% en GPQA Diamond, 95.0% en GSM8K y 84.9% en HumanEval, por delante del 86.4%, 35.7%, 92.0% y 67.0% de GPT-4[1]
- Una ventana de contexto de 200K tokens en el lanzamiento, con entradas de más de 1 millón de tokens disponibles «para casos de uso específicos»; en la prueba de recuperación Needle In A Haystack superó el 99% de precisión y en ocasiones detectó que la frase insertada parecía añadida artificialmente[1][5]
- El primer modelo de visión de Claude: lee fotos, gráficos, diagramas y esquemas técnicos, hasta 20 imágenes en una sola solicitud, pero no identificará a personas[1][5]
- Opus tiene «una probabilidad significativamente menor» que los modelos anteriores de Claude de rechazar solicitudes inocuas, y duplica la precisión de Claude 2.1 en preguntas factuales abiertas y difíciles; su conocimiento llega hasta agosto de 2023[1][2]
Pruebas de referencia[1]
| Prueba de referencia | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| MMLU (conocimiento de nivel universitario) | 86.8% 5 shot | 79.0% 5-shot | 75.2% 5-shot | 86.4% 5-shot | 70.0% 5-shot | 83.7% 5-shot | 71.8% 5-shot |
| GPQA, Diamond (razonamiento de nivel de posgrado) | 50.4% 0-shot CoT | 40.4% 0-shot CoT | 33.3% 0-shot CoT | 35.7% 0-shot CoT | 28.1% 0-shot CoT | — | — |
| GSM8K (matemáticas de escuela primaria) | 95.0% 0-shot CoT | 92.3% 0-shot CoT | 88.9% 0-shot CoT | 92.0% 5-shot CoT | 57.1% 5-shot | 94.4% Maj1@32 | 86.5% Maj1@32 |
| MATH (resolución de problemas matemáticos) | 60.1% 0-shot CoT | 43.1% 0-shot CoT | 38.9% 0-shot CoT | 52.9% 4-shot | 34.1% 4-shot | 53.2% 4-shot | 32.6% 4-shot |
| MGSM (matemáticas multilingües) | 90.7% 0-shot | 83.5% 0-shot | 75.1% 0-shot | 74.5% 8-shot | — | 79.0% 8-shot | 63.5% 8-shot |
| HumanEval (código) | 84.9% 0-shot | 73.0% 0-shot | 75.9% 0-shot | 67.0% 0-shot | 48.1% 0-shot | 74.4% 0-shot | 67.7% 0-shot |
| DROP, puntuación F1 (razonamiento sobre texto) | 83.1 3-shot | 78.9 3-shot | 78.4 3-shot | 80.9 3-shot | 64.1 3-shot | 82.4 Variable shots | 74.1 Variable shots |
| BIG-Bench-Hard (evaluaciones mixtas) | 86.8% 3-shot CoT | 82.9% 3-shot CoT | 73.7% 3-shot CoT | 83.1% 3-shot CoT | 66.6% 3-shot CoT | 83.6% 3-shot CoT | 75.0% 3-shot CoT |
| ARC-Challenge (preguntas y respuestas de conocimiento) | 96.4% 25-shot | 93.2% 25-shot | 89.2% 25-shot | 96.3% 25-shot | 85.2% 25-shot | — | — |
| HellaSwag (conocimiento común) | 95.4% 10-shot | 89.0% 10-shot | 85.9% 10-shot | 95.3% 10-shot | 85.5% 10-shot | 87.8% 10-shot | 84.7% 10-shot |
Referencias 590% DE CONFIANZAConfianza general: 90%Hasta qué punto la fuente y las referencias del pin respaldan sus fechas.Media ponderada de la firmeza con la que 5 referencias, incluida la fuente, respaldan las horas de inicio y fin del pin; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más recienteMostrar todos los pines con un 75% de confianza o más
La primera entrada es siempre la fuente del pin. La confianza global es una media ponderada de la firmeza con la que cada referencia respalda las horas de inicio y fin usadas arriba; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más reciente.
- [1]90%anthropic.com/news/claude-3-familyanthropic.com· Publicado el 28 sept 2026· Empieza 4 mar 2024 ✓· 33% de la puntuación
La publicación de Anthropic[2] está fechada el «4 de marzo de 2024» y dice que «Opus y Sonnet ya están disponibles para usarse en claude[3].ai y en la API de Claude, que ahora está disponible con carácter general en 159 países»; CNBC[4] y TechCrunch[5] informan del lanzamiento ese mismo lunes.
- [2]90%The Claude 3 Model Family: Opus, Sonnet, Haiku (model card)anthropic.com· Añadido el 28 sept 2026· 33% de la puntuación
Anthropic's[1] Claude[3] 3 model card (the link resolves to the PDF): the Claude 3 models' knowledge cutoff is August 2023 and they are offered through the Claude API, Amazon Bedrock and Google Vertex AI; it carries the full evaluations behind the launch post's table.
- [3]90%Model deprecations - Claude Platform Docsplatform.claude.com· Añadido el 28 sept 2026· 33% de la puntuación
Anthropic's[1][2] deprecation history: on 30 June 2025 it notified developers of Claude Opus 3's retirement, and claude-3-opus-20240229 was retired on 5 January 2026 with claude-opus-4-8 as the recommended replacement.
- [4]85%Anthropic, backed by Amazon and Google, debuts its most powerful chatbot yetcnbc.com· Publicado el 4 mar 2024· Empieza 4 mar 2024· 1% de la puntuación
CNBC's same-day report (published 2024-03-04T14:00Z): "Anthropic[1][2] on Monday debuted Claude[3] 3"; Opus outperformed GPT-4 and Gemini Ultra on benchmark tests, it is Anthropic's first multimodal model, Opus and Sonnet are available in 159 countries, and Anthropic's backers include Google, Salesforce and Amazon after about $7.3 billion in funding deals over the past year.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· Publicado el 4 mar 2024· Empieza 4 mar 2024· 1% de la puntuación
TechCrunch (Kyle Wiggers, 11:50 AM PST, 4 March 2024): Claude[3] 3 is Anthropic's[1][2] first multimodal model, can analyze up to 20 images in one request, starts with a 200,000-token context window (1 million for select customers), answers from data before August 2023, and Opus costs $15 per million input and $75 per million output tokens.
Sugerir una corrección
¿Falta algo o hay un error? Dilo con tus palabras: un enlace que respalde este pin, otra fecha de inicio o fin y por qué, o un dato que falta o está mal. La IA lo contrasta con las fuentes del pin, busca otras mejores y añade cualquier página que te dé la razón. Las fuentes del propio pin siguen contando más. La IA también mira las imágenes: una que muestra otra cosa, o la muestra mal, pasa al final o se sustituye.