- Inicio
- 19 may 202695% DE CONFIANZAsegún deepmind.google
Lanzamiento de Gemini 3.5 Flash
Traducido automáticamente del original
Título original: Gemini 3.5 Flash Released
- Google lanzó Gemini 3.5 Flash el 19 de mayo de 2026 en Google I/O, que según la compañía es su modelo más potente hasta ahora para programación y agentes autónomos[1]
- Koray Kavukcuoglu dijo que «supera a nuestro último modelo de vanguardia, 3.1 Pro, en casi todos los benchmarks», que es 4 veces más rápido que otros modelos de vanguardia y que una versión optimizada es 12 veces más rápida con la misma calidad[1]
- Se desarrolló junto con Google Antigravity y, en una demostración, varios agentes crearon un sistema operativo completo desde cero; Google lanzó ese mismo día Antigravity 2.0, una aplicación de escritorio independiente[1]
- Google dijo que un futuro 3.5 Pro actuaría como «orquestador» con Flash como subagentes, y que 3.5 refuerza las salvaguardas frente a riesgos cibernéticos y CBRN[1]
Características principales
- Terminal-bench 2.1 76.2% (3 Flash 58.0%), SWE-Bench Pro 55.1% y OSWorld-Verified 78.4% en uso del ordenador[3]
- MCP Atlas 83.6%, GDPval-AA 1656 Elo en trabajo del conocimiento, CharXiv Reasoning 84.2% y ARC-AGI-2 72.1%[3]
- Puede funcionar de forma autónoma durante varias horas y se detiene a pedir indicaciones en los puntos de decisión[1]
Benchmarks[3]
| Benchmark | Gemini 3.5 Flash | Gemini 3 Flash | Gemini 3.1 Pro | Claude Sonnet 4.6 | Claude Opus 4.7 | GPT-5.5 |
|---|---|---|---|---|---|---|
| Terminal-bench 2.1 (programación agéntica en terminal, arnés Terminus-2) | 76.2% | 58.0% | 70.3% | — | 66.1% | 78.2% |
| SWE-Bench Pro (Public) (tareas variadas de programación agéntica, un solo intento) | 55.1% | 49.6% | 54.2% | — | 64.3% | 58.6% |
| MCP Atlas (flujos de trabajo de varios pasos con MCP) | 83.6% | 62.0% | 78.2% | 69.5% | 79.1% | 75.3% |
| Toolathlon (uso general de herramientas en el mundo real) | 56.5% | 49.4% | — | — | — | 55.6% |
| OSWorld-Verified (uso agéntico del ordenador) | 78.4% | 65.1% | 76.2% | 72.5% | 78.0% | 78.7% |
| Finance Agent v2 (análisis financiero y toma de decisiones) | 57.9% | 42.6% | 43.0% | 51.0% | 51.5% | 51.8% |
| GDPval-AA (trabajo del conocimiento de valor económico, Elo) | 1656 | 1204 | 1314 | 1676 | 1753 | 1769 |
| CharXiv Reasoning (síntesis de información a partir de gráficos complejos, sin herramientas) | 84.2% | 80.3% | 83.3% | 72.4% | 82.1% | 84.1% |
| MMMU-Pro (comprensión y razonamiento multimodal, sin herramientas) | 83.6% | 81.2% | 80.5% | 74.5% | 75.2% | 81.2% |
| Blueprint-Bench 2 (razonamiento espacial agéntico, puntuación normalizada) | 33.6% | 0.0% | 26.5% | 6.7% | 24.5% | 36.2% |
| MRCR v2 (8-needle) (rendimiento en contexto largo, 128k (media)) | 77.3% | 67.2% | 84.9% | 84.9% | 59.3% | 94.8% |
| MRCR v2 (8-needle) (rendimiento en contexto largo, 1M (puntual)) | 26.6% | 22.1% | 26.3% | — | — | — |
| Humanity’s Last Exam (razonamiento académico (conjunto completo, texto + MM)) | 40.2% | 33.7% | 44.4% | 33.2% | 46.9% | 41.4% |
| ARC-AGI-2 (puzles de razonamiento abstracto) | 72.1% | 33.6% | 77.1% | 58.3% | 75.8% | 84.6% |
Referencias 385% DE CONFIANZAConfianza general: 85%Hasta qué punto la fuente y las referencias del pin respaldan sus fechas.Media ponderada de la firmeza con la que 3 referencias, incluida la fuente, respaldan las horas de inicio y fin del pin; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más recienteMostrar todos los pines con un 75% de confianza o más
La primera entrada es siempre la fuente del pin. La confianza global es una media ponderada de la firmeza con la que cada referencia respalda las horas de inicio y fin usadas arriba; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más reciente.
- [1]90%techcrunch.com/2026/05/19/with-gemini-3-5-flash-google-bets-its-next-ai-wave-on-agents-not-chatbotstechcrunch.com· Publicado el 30 sept 2026· Empieza 19 may 2026· 39% de la puntuación
TechCrunch informa de que Google lanzó Gemini 3.5 Flash el martes 19 de mayo de 2026 en su conferencia anual para desarrolladores I/O; la ficha del modelo 3.5 Flash de Google DeepMind[3] se publicó el mismo día.
- [2]75%Gemini (language model) - Wikipediaen.wikipedia.org· Añadido el 30 sept 2026· 39% de la puntuación
The Wikipedia article lists Gemini 3.5 Flash as released on 19 May 2026, based on Gemini 3 Flash.
- [3]95%Gemini 3.5 Flash - Model Carddeepmind.google· Publicado el 19 may 2026· Empieza 19 may 2026 ✓· 23% de la puntuación
DeepMind's model card, published 19 May 2026, gives the benchmark results against Gemini 3 Flash, 3.1 Pro, Claude Sonnet 4.6, Claude Opus 4.7 and GPT-5.5.
Sugerir una corrección
¿Falta algo o hay un error? Dilo con tus palabras: un enlace que respalde este pin, otra fecha de inicio o fin y por qué, o un dato que falta o está mal. La IA lo contrasta con las fuentes del pin, busca otras mejores y añade cualquier página que te dé la razón. Las fuentes del propio pin siguen contando más. La IA también mira las imágenes: una que muestra otra cosa, o la muestra mal, pasa al final o se sustituye.