- Início
- 30 de set. de 202690% DE CONFIANÇAde a fonte
Gemini 4 Argon é anunciado
Traduzido automaticamente do original
Título original: Gemini 4 Argon Announced
- O Google anunciou o Gemini 4 Argon em 30 de setembro de 2026, chamando-o de seu “novo modelo de fronteira” para engenharia de software no mundo real, trabalho do conhecimento corporativo, como jurídico e financeiro, e defesa em cibersegurança[1]
- Ele está sendo liberado primeiro a um grupo de defensores cibernéticos de confiança pelo Fairwind Program, e o Google participa do processo voluntário do governo dos EUA para acesso a modelos antes do lançamento, enquanto amplia o acesso gradualmente[1]
- O Google o disponibilizará a desenvolvedores, empresas e consumidores “o mais rápido possível”, começando por clientes pagos da API e assinantes do Google AI Ultra, então o lançamento amplo ainda está pendente[1]
- Internamente, ele já move os fluxos de trabalho do Google: agentes liberaram mais de 300 TiB de memória nos data centers, superaram em 40% uma linha de base de sub-rotina quântica e ajudaram a migrar de C/C++ para Rust até mais de 800 mil linhas do kernel Zircon do Fuchsia OS[1]
- Em uma demonstração de defesa cibernética, encontrou uma vulnerabilidade crítica em um software de saúde usado por hospitais do mundo todo que modelos de fronteira anteriores não haviam detectado[1]
Destaques
- Limite de saída ampliado para 1 milhão de tokens, ante 64 mil, para que o modelo possa raciocinar por centenas de milhares de tokens em uma única trajetória[1]
- Preço introdutório de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída, com entrada em cache 95% mais barata; depois, US$ 4 e US$ 20 por milhão[1]
- Novo estado da arte no DeepSWE v1.1, com 77,9% (GPT-6 Astra 74,1%, Claude Opus 5.5 74,2%), e primeiro no AutomationBench, com 51,3%, e no Vals Index, com 68,9%[1][2]
- Compreensão de vídeos longos LVBench 91,7%, Vals Finance Agent v2 65,4% e Harvey's Legal Agent Benchmark 19,6%[1][2]
- Correção de vulnerabilidades no CWE-bench v1 68,0%, empatado em primeiro; o Google o libera sem proteções cibernéticas a defensores de confiança e às suas próprias equipes[1][2]
- Salvaguardas: recusa de pedidos nocivos preservando a ciência legítima de duplo uso, melhor pontuação no benchmark de injeção indireta de prompt da Gray Swan, monitoramento de cadeia de raciocínio e de ações que interrompe execuções fora dos limites e sandboxes reforçados[1][2]
Benchmarks[2]
| Benchmark | Gemini 4 Argon | GPT-6 Astra | Claude Fable 5.1 | Claude Opus 5.5 |
|---|---|---|---|---|
| Vals Index (trabalho do conhecimento) | 68,9% | 63,1% | 65,8% | 67,0% |
| AutomationBench (trabalho do conhecimento, pontuação) | 51,3% | 41,4% | 31,4% | 42,5% |
| Vals Finance Agent v2 (trabalho do conhecimento) | 65,4% | 53,5% | 58,9% | 58,6% |
| Harvey's Legal Agent Benchmark (trabalho do conhecimento) | 19,6% | 5,4% | 6,7% | 3,8% |
| DeepSWE v1.1 (programação com agentes) | 77,9% | 74,1% | 67,4% | 74,2% |
| FrontierSWE v2 (programação com agentes) | 55,0% | 65,5% | 56,3% | 62,3% |
| Vibe Code Bench (programação com agentes) | 91,9% | 89,6% | 90,3% | 90,3% |
| Terminal-bench 4.0 (programação com agentes) | 57,4% | 58,2% | 57,9% | 66,4% |
| PostTrainBench (engenharia de ML) | 45,3% | 44,3% | 40,2% | 49,3% |
| Terminal-Bench Science 0.1 (ciências e matemática) | 57,6% | 68,1% | 52,6% | 63,3% |
| LABBench 2 (ciências e matemática) | 88,8% | 85,4% | 68,6% | 73,1% |
| RiemannBench (ciências e matemática) | 76,0% | 72,0% | 65,6% | 69,6% |
| GraphWalks (contexto longo, até 128k, BFS (F1)) | 99,7% | 98,7% | 91,4% | 90,6% |
| GraphWalks (contexto longo, de 256k a 1M, BFS (F1)) | 84,2% | 71,8% | 65,0% | 66,8% |
| Agent's Last Exam (uso do computador, taxa de aprovação) | 39,5% | 34,2% | — | 38,2% |
| OSWorld-2.0 (uso do computador, subconjunto offline, pontuação parcial) | 69,2% | 72,6% | — | — |
| Chartography (compreensão multimodal) | 71,6% | 71,0% | 46,2% | 66,3% |
| LVBench (compreensão multimodal) | 91,7% | 87,5% | 79,7% | 83,7% |
| CWE-bench v1 (cibersegurança) | 68,0% | 68,0% | 58,0% | 67,0% |
Referências 287% DE CONFIANÇAConfiança geral: 87%Quanto a fonte e as referências do pin sustentam suas datas.Média ponderada de quanto 2 referências, incluindo a fonte, sustentam os horários de início e fim do pin; uma referência conta metade a cada 180 dias a mais em relação à mais recenteMostrar todos os pins com confiança de 75% ou mais
A primeira entrada é sempre a fonte do pin. A confiança geral é uma média ponderada de quanto cada referência sustenta os horários de início e fim usados acima; uma referência conta metade a cada 180 dias a mais em relação à mais recente.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argonblog.google· Postado em 30 de set. de 2026· Início 30 de set. de 2026 ✓· 50% da pontuação
O texto do Google, “Gemini 4 Argon: our next era of frontier intelligence” (“Gemini 4 Argon: nossa próxima era de inteligência de fronteira”), é datado de 30 de setembro de 2026 e diz “Hoje, estamos anunciando nosso novo modelo de fronteira, o Gemini 4 Argon, que está sendo liberado a um grupo de defensores cibernéticos de confiança”; a disponibilidade ampla para desenvolvedores, empresas e consumidores vem “o mais rápido possível” (veja o pin estimado 4810).
- [2]85%Gemini - Google DeepMinddeepmind.google· Adicionado em 30 de set. de 2026· Início 30 de set. de 2026· 50% da pontuação
DeepMind's Gemini page now leads with Gemini 4 Argon and carries its benchmark table against GPT-6 Astra, Claude Fable 5.1 and Claude Opus 5.5, plus the four safeguard areas Google is strengthening before broad availability.
Sugerir uma correção
Falta algo ou há um erro? Diga com suas palavras: um link que sustente este pin, uma data de início ou fim diferente e por quê, ou um fato que falta ou está errado. A IA confere isso com as fontes do pin, procura outras melhores e adiciona qualquer página que dê razão a você. As fontes do próprio pin continuam contando mais. Uma imagem que mostra outra coisa, ou mostra mal, também é analisada e rebaixada ou substituída.