- Inicio
- 5 ago 202590% DE CONFIANZAsegún la fuente
Anthropic lanza Claude Opus 4.1
Traducido automáticamente del original
Título original: Claude Opus 4.1 Released
- Anthropic lanzó Claude Opus 4.1 el 5 de agosto de 2025 para los usuarios de pago de Claude, en Claude Code, y en su API, Amazon Bedrock y Vertex AI de Google Cloud, al mismo precio que Opus 4[1][2]
- Salió el mismo día en que OpenAI lanzó sus primeros modelos de razonamiento de pesos abiertos desde 2019; Anthropic dijo que planeaba «mejoras sustancialmente mayores en nuestros modelos en las próximas semanas»[1][6]
- GitHub lo incorporó a Copilot ese mismo día como vista previa pública para los planes Enterprise y Pro+[5]
- Como Opus 4, se implementa bajo el estándar de seguridad ASL-3[3]
- Se retiró de la API de Claude el 5 de agosto de 2026, exactamente un año después de su lanzamiento, sustituido por Claude Opus 4.8[4]
Características destacadas
- Una mejora de Claude Opus 4 «en tareas agénticas, codificación del mundo real y razonamiento», con mejor investigación en profundidad y análisis de datos, «especialmente en el seguimiento de detalles y la búsqueda agéntica»[1]
- 74.5% en SWE-bench Verified frente al 72.5% de Opus 4, y 43.3% en Terminal-Bench frente al 39.2%[1][6]
- Otras puntuaciones de la tabla de Anthropic: 80.9% en GPQA Diamond, 82.4% en TAU-bench retail, 89.5% en MMMLU y 78.0% en AIME 2025[1]
- Informes de clientes: GitHub observa mejoras notables en la refactorización de múltiples archivos, Rakuten correcciones precisas en bases de código grandes «sin hacer ajustes innecesarios», y Windsurf un salto de una desviación estándar respecto a Opus 4[1]
- Con el mismo precio que Opus 4: $15 por millón de tokens de entrada y $75 por millón de tokens de salida; identificador de la API claude-opus-4-1-20250805[1][6]
Pruebas de referencia[1]
| Prueba de referencia | Claude Opus 4.1 | Claude Opus 4 | Claude Sonnet 4 | OpenAI o3 | Gemini 2.5 Pro |
|---|---|---|---|---|---|
| SWE-bench Verified¹ (codificación agéntica) | 74.5% | 72.5% | 72.7% | 69.1% | 67.2% |
| Terminal-Bench² (codificación agéntica en terminal) | 43.3% | 39.2% | 35.5% | 30.2% | 25.3% |
| GPQA Diamond (razonamiento de nivel de posgrado) | 80.9% | 79.6% | 75.4% | 83.3% | 86.4% |
| TAU-bench (uso agéntico de herramientas) | Minorista 82.4%, Aerolínea 56.0% | Minorista 81.4%, Aerolínea 59.6% | Minorista 80.5%, Aerolínea 60.0% | Minorista 70.4%, Aerolínea 52.0% | — |
| MMMLU³ (preguntas y respuestas multilingües) | 89.5% | 88.8% | 86.5% | 88.8% | — |
| MMMU, validación (razonamiento visual) | 77.1% | 76.5% | 74.4% | 82.9% | 82% |
| AIME 2025⁴ (competencia de matemáticas de secundaria) | 78.0% | 75.5% | 70.5% | 88.9% | 88% |
¹ Opus 4.1, Opus 4 y Sonnet 4 se ejecutan pass@1 con herramientas de bash/editor, promediados en 10 pruebas, parches de un solo intento, sin cómputo en tiempo de prueba. ² Marco de agente predeterminado (Terminus 1), promediado en 5 pruebas. ³ Las puntuaciones de Claude son el promedio sobre 14 idiomas distintos del inglés. ⁴ Ejecutado con muestreo de núcleo, top_p 0.95.
Referencias 689% DE CONFIANZAConfianza general: 89%Hasta qué punto la fuente y las referencias del pin respaldan sus fechas.Media ponderada de la firmeza con la que 6 referencias, incluida la fuente, respaldan las horas de inicio y fin del pin; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más recienteMostrar todos los pines con un 75% de confianza o más
La primera entrada es siempre la fuente del pin. La confianza global es una media ponderada de la firmeza con la que cada referencia respalda las horas de inicio y fin usadas arriba; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más reciente.
- [1]90%anthropic.com/news/claude-opus-4-1anthropic.com· Publicado el 28 sept 2026· Empieza 5 ago 2025 ✓· 23% de la puntuación
La publicación de Anthropic[3] está fechada el «5 de agosto de 2025»: «Hoy lanzamos Claude[2][4] Opus 4.1 ... ya disponible para los usuarios de pago de Claude y en Claude Code. También está en nuestra API, Amazon Bedrock y Vertex AI de Google Cloud»; las notas de la versión de Claude y el registro de cambios de GitHub[5] llevan la misma fecha.
- [2]90%Claude Platform release notes - Claude Platform Docsplatform.claude.com· Añadido el 28 sept 2026· 23% de la puntuación
"August 5, 2025 We've launched Claude[4] Opus 4.1, an incremental update to Claude Opus 4", which does not allow both temperature and top_p to be set; later entries record structured outputs launching for Opus 4.1 (14 November 2025) and its retirement.
- [3]90%System Card Addendum: Claude Opus 4.1anthropic.com· Añadido el 28 sept 2026· 23% de la puntuación
Anthropic's[1] system card addendum: "Like Claude[2][4] Opus 4, Claude Opus 4.1 is deployed under the AI Safety Level 3 (ASL-3) Standard"; it is not "notably more capable" than Opus 4 under the RSP, so new evaluations were voluntary.
- [4]90%Model deprecations - Claude Platform Docsplatform.claude.com· Añadido el 28 sept 2026· 23% de la puntuación
Anthropic[1][3] notified developers on 5 June 2026 that Claude[2] Opus 4.1 (claude-opus-4-1-20250805) would be retired; it was retired on 5 August 2026, one year after release, with claude-opus-4-8 as the replacement.
- [5]85%Anthropic Claude Opus 4.1 is now in public preview in GitHub Copilotgithub.blog· Publicado el 5 ago 2025· Empieza 5 ago 2025· 5% de la puntuación
GitHub's changelog, "Release August 5, 2025": Claude[2][4] Opus 4.1, "the successor to Claude Opus 4", is available in GitHub Copilot Chat for Copilot Enterprise and Pro+ plans on github.com, Visual Studio Code and GitHub Mobile.
Sugerir una corrección
¿Falta algo o hay un error? Dilo con tus palabras: un enlace que respalde este pin, otra fecha de inicio o fin y por qué, o un dato que falta o está mal. La IA lo contrasta con las fuentes del pin, busca otras mejores y añade cualquier página que te dé la razón. Las fuentes del propio pin siguen contando más. La IA también mira las imágenes: una que muestra otra cosa, o la muestra mal, pasa al final o se sustituye.