- Início
- 19 de mai. de 202695% DE CONFIANÇAde deepmind.google
Gemini 3.5 Flash é lançado
Traduzido automaticamente do original
Título original: Gemini 3.5 Flash Released
- O Google lançou o Gemini 3.5 Flash em 19 de maio de 2026 no Google I/O, que segundo ela é seu modelo mais forte até agora para programação e agentes autônomos[1]
- Koray Kavukcuoglu disse que ele “supera nosso mais recente modelo de fronteira, o 3.1 Pro, em quase todos os benchmarks” e que é 4x mais rápido que outros modelos de fronteira, com uma versão otimizada 12x mais rápida com a mesma qualidade[1]
- Foi desenvolvido em conjunto com o Google Antigravity e, em uma demonstração, agentes foram gerados para construir um sistema operacional inteiro do zero; o Google lançou o Antigravity 2.0, um aplicativo de desktop independente, no mesmo dia[1]
- O Google disse que um futuro 3.5 Pro atuaria como “orquestrador” com o Flash como subagentes e que o 3.5 tem salvaguardas reforçadas de cibersegurança e CBRN[1]
Destaques
- Terminal-bench 2.1 76,2% (3 Flash 58,0%), SWE-Bench Pro 55,1% e OSWorld-Verified 78,4% em uso do computador[3]
- MCP Atlas 83,6%, GDPval-AA 1656 de Elo em trabalho do conhecimento, CharXiv Reasoning 84,2% e ARC-AGI-2 72,1%[3]
- Pode rodar de forma autônoma por várias horas, parando para pedir informações em pontos de decisão[1]
Benchmarks[3]
| Benchmark | Gemini 3.5 Flash | Gemini 3 Flash | Gemini 3.1 Pro | Claude Sonnet 4.6 | Claude Opus 4.7 | GPT-5.5 |
|---|---|---|---|---|---|---|
| Terminal-bench 2.1 (programação em terminal com agentes, harness Terminus-2) | 76,2% | 58,0% | 70,3% | — | 66,1% | 78,2% |
| SWE-Bench Pro (pública) (tarefas variadas de programação com agentes, tentativa única) | 55,1% | 49,6% | 54,2% | — | 64,3% | 58,6% |
| MCP Atlas (fluxos de trabalho em várias etapas com MCP) | 83,6% | 62,0% | 78,2% | 69,5% | 79,1% | 75,3% |
| Toolathlon (uso geral de ferramentas no mundo real) | 56,5% | 49,4% | — | — | — | 55,6% |
| OSWorld-Verified (uso do computador por agentes) | 78,4% | 65,1% | 76,2% | 72,5% | 78,0% | 78,7% |
| Finance Agent v2 (análise financeira e tomada de decisão) | 57,9% | 42,6% | 43,0% | 51,0% | 51,5% | 51,8% |
| GDPval-AA (trabalho do conhecimento economicamente valioso, Elo) | 1656 | 1204 | 1314 | 1676 | 1753 | 1769 |
| CharXiv Reasoning (síntese de informações de gráficos complexos, sem ferramentas) | 84,2% | 80,3% | 83,3% | 72,4% | 82,1% | 84,1% |
| MMMU-Pro (compreensão e raciocínio multimodais, sem ferramentas) | 83,6% | 81,2% | 80,5% | 74,5% | 75,2% | 81,2% |
| Blueprint-Bench 2 (raciocínio espacial com agentes, pontuação normalizada) | 33,6% | 0,0% | 26,5% | 6,7% | 24,5% | 36,2% |
| MRCR v2 (8-needle) (desempenho em contexto longo, 128k (média)) | 77,3% | 67,2% | 84,9% | 84,9% | 59,3% | 94,8% |
| MRCR v2 (8-needle) (desempenho em contexto longo, 1M (pontual)) | 26,6% | 22,1% | 26,3% | — | — | — |
| Humanity’s Last Exam (raciocínio acadêmico (conjunto completo, texto + MM)) | 40,2% | 33,7% | 44,4% | 33,2% | 46,9% | 41,4% |
| ARC-AGI-2 (quebra-cabeças de raciocínio abstrato) | 72,1% | 33,6% | 77,1% | 58,3% | 75,8% | 84,6% |
Referências 385% DE CONFIANÇAConfiança geral: 85%Quanto a fonte e as referências do pin sustentam suas datas.Média ponderada de quanto 3 referências, incluindo a fonte, sustentam os horários de início e fim do pin; uma referência conta metade a cada 180 dias a mais em relação à mais recenteMostrar todos os pins com confiança de 75% ou mais
A primeira entrada é sempre a fonte do pin. A confiança geral é uma média ponderada de quanto cada referência sustenta os horários de início e fim usados acima; uma referência conta metade a cada 180 dias a mais em relação à mais recente.
- [1]90%techcrunch.com/2026/05/19/with-gemini-3-5-flash-google-bets-its-next-ai-wave-on-agents-not-chatbotstechcrunch.com· Postado em 30 de set. de 2026· Início 19 de mai. de 2026· 39% da pontuação
A TechCrunch informa que o Google lançou o Gemini 3.5 Flash na terça-feira, 19 de maio de 2026, em sua conferência anual de desenvolvedores I/O; o model card do Google DeepMind[3] para o 3.5 Flash foi publicado no mesmo dia.
- [2]75%Gemini (language model) - Wikipediaen.wikipedia.org· Adicionado em 30 de set. de 2026· 39% da pontuação
The Wikipedia article lists Gemini 3.5 Flash as released on 19 May 2026, based on Gemini 3 Flash.
- [3]95%Gemini 3.5 Flash - Model Carddeepmind.google· Publicado em 19 de mai. de 2026· Início 19 de mai. de 2026 ✓· 23% da pontuação
DeepMind's model card, published 19 May 2026, gives the benchmark results against Gemini 3 Flash, 3.1 Pro, Claude Sonnet 4.6, Claude Opus 4.7 and GPT-5.5.
Sugerir uma correção
Falta algo ou há um erro? Diga com suas palavras: um link que sustente este pin, uma data de início ou fim diferente e por quê, ou um fato que falta ou está errado. A IA confere isso com as fontes do pin, procura outras melhores e adiciona qualquer página que dê razão a você. As fontes do próprio pin continuam contando mais. Uma imagem que mostra outra coisa, ou mostra mal, também é analisada e rebaixada ou substituída.