- Inicio
- 13 ago 202695% DE CONFIANZAsegún deepmind.google
Lanzamiento de Gemini 3.7 Flash
Traducido automáticamente del original
Título original: Gemini 3.7 Flash Released
- Google lanzó Gemini 3.7 Flash el 13 de agosto de 2026, solo tres semanas después de 3.6 Flash, y lo calificó de «resultado directo de los comentarios de los desarrolladores y de innovaciones algorítmicas»[1]
- Logra «grandes mejoras» sobre 3.6 Flash en depuración y resolución de incidencias, con DeepSWE v1.1 subiendo del 49.0% al 65.3% y FrontierCode 1.1 Main del 34.4% al 43.6%[1]
- En la app de Gemini se desplegó primero en Spark, para los suscriptores de AI Pro y Ultra[1]
Características principales
- Precio introductorio de $0.75 por million de tokens de entrada y $3.75 por million de tokens de salida hasta finales de 2026, la mitad del precio con el que se lanzó 3.6 Flash[1][2]
- WebDev Arena Elo 1588 (3.6 Flash 1538); comprensión de documentos GDP.pdf 34.0% frente a 22.0%; AutomationBench 30.4% frente a 17.0%[1]
- Terminal-bench 2.1 85.8%, OSWorld-2.0 47.9% y un Artificial Analysis Intelligence Index de 56[2]
- Salvaguardas actualizadas frente al uso indebido químico, biológico, radiológico y nuclear y a la ofensiva cibernética[1]
Benchmarks[2]
| Benchmark | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra | Muse Spark 1.2 |
|---|---|---|---|---|---|
| Precio de entrada ($/1M de tokens) | $0.75* | $0.75* | $2.00 | $2.00 | $1.25 |
| Precio de salida ($/1M de tokens) | $3.75* | $3.75* | $10.00 | $12.00 | $4.25 |
| Artificial Analysis Intelligence Index (inteligencia compuesta del modelo) | 56 | 52 | 55 | 57 | 57 |
| FrontierCode 1.1 Main (calidad del código en producción, puntuación) | 43.6% | 34.4% | 42.7% | 41.3% | — |
| DeepSWE v1.1 (ingeniería de software de largo horizonte) | 65.3% | 48.6% | 53.8% | 69.6% | 54.9% |
| Code Arena (desarrollo web, Elo) | 1588 | 1538 | 1541 | 1523 | 1535 |
| Terminal-bench 2.1 (programación agéntica en terminal) | 85.8% | 78.0% | 80.4% | 87.4% | 82.9% |
| Terminal-bench 3.0 (capacidades generales de agente) | 14.9% | 5.4% | 14.6% | 20.8% | — |
| AutomationBench (automatización de flujos de trabajo empresariales, conjunto privado) | 30.4% | 17.0% | 10.7% | 23.6% | — |
| GDPVal-AA v2 (trabajo del conocimiento, Elo) | 1525 | 1422 | 1598 | 1578 | 1628 |
| Harvey LAB-AA (flujos de trabajo jurídicos complejos) | 90.7% | 85.1% | 90.1% | 85.2% | — |
| GDP.pdf (comprensión experta de documentos PDF) | 34.0% | 22.0% | 28.0% | 24.7% | 16.0% |
| CharXiv Reasoning (síntesis de información a partir de gráficos complejos, sin herramientas) | 84.5% | 85.2% | 77.0% | 85.9% | — |
| CharXiv Reasoning (síntesis de información a partir de gráficos complejos, con herramientas) | 88.7% | 89.4% | 88.3% | — | — |
| LVBench (comprensión de vídeos largos) | 85.4% | 84.2% | 68.5% | 78.9% | — |
| GDM-MRCR v2 (8-needle) (rendimiento en contexto largo, 128k (media)) | 97.0% | 91.8% | 81.5% | 93.5% | — |
| OSWorld-2.0 (uso agéntico del ordenador) | 47.9% | 33.8% | — | 50.2% | — |
| Agent's Last Exam (tareas multimodales de agentes de escritorio y sistema operativo, tasa de aciertos) | 26.3% | 24.2% | 33.3% | 28.0% | — |
| HLE-Verified (razonamiento experto multidisciplinar) | 53.6% | 51.2% | 31.0% | 51.1% | — |
| BioMysteryBench (razonamiento en investigación bioinformática, resoluble por humanos) | 87.1% | 80.6% | 87.5% | 83.8% | — |
| BioMysteryBench (razonamiento en investigación bioinformática, difícil para humanos) | 43.5% | 41.2% | 34.1% | 49.4% | — |
| LABBench2 (tareas de investigación biológica del mundo real) | 82.1% | 76.1% | 80.1% | 81.2% | — |
Referencias 292% DE CONFIANZAConfianza general: 92%Hasta qué punto la fuente y las referencias del pin respaldan sus fechas.Media ponderada de la firmeza con la que 2 referencias, incluida la fuente, respaldan las horas de inicio y fin del pin; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más recienteMostrar todos los pines con un 75% de confianza o más
La primera entrada es siempre la fuente del pin. La confianza global es una media ponderada de la firmeza con la que cada referencia respalda las horas de inicio y fin usadas arriba; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más reciente.
- [1]90%9to5google.com/2026/08/13/gemini-3-7-flash-launch9to5google.com· Publicado el 30 sept 2026· Empieza 13 ago 2026· 55% de la puntuación
El reportaje de lanzamiento de 9to5Google está fechado el 13 de agosto de 2026 y dice que Google «anunció hoy Gemini 3.7 Flash»; la ficha del modelo de DeepMind[2] se publicó el 13 de agosto de 2026.
- [2]95%Gemini 3.7 Flash - Model Carddeepmind.google· Publicado el 13 ago 2026· Empieza 13 ago 2026 ✓· 45% de la puntuación
DeepMind's model card, published 13 August 2026, lists the introductory prices and a benchmark table against 3.6 Flash, Claude Sonnet 5, GPT-5.6 Terra and Muse Spark 1.2.
Sugerir una corrección
¿Falta algo o hay un error? Dilo con tus palabras: un enlace que respalde este pin, otra fecha de inicio o fin y por qué, o un dato que falta o está mal. La IA lo contrasta con las fuentes del pin, busca otras mejores y añade cualquier página que te dé la razón. Las fuentes del propio pin siguen contando más. La IA también mira las imágenes: una que muestra otra cosa, o la muestra mal, pasa al final o se sustituye.