- Inizio
- 19 mag 2026AFFIDABILITÀ 95%da deepmind.google
Rilasciato Gemini 3.5 Flash
Tradotto automaticamente dall’originale
Titolo originale: Gemini 3.5 Flash Released
- Google ha lanciato Gemini 3.5 Flash il 19 maggio 2026 al Google I/O, che a suo dire è il suo modello più forte finora per la programmazione e gli agenti autonomi[1]
- Koray Kavukcuoglu ha detto che «supera il nostro ultimo modello di frontiera, 3.1 Pro, in quasi tutti i benchmark» e che è 4 volte più veloce degli altri modelli di frontiera, con una versione ottimizzata 12 volte più veloce a pari qualità[1]
- È stato sviluppato insieme a Google Antigravity e, in una demo, degli agenti sono stati generati per costruire da zero un intero sistema operativo; lo stesso giorno Google ha rilasciato Antigravity 2.0, un'app desktop autonoma[1]
- Google ha detto che un futuro 3.5 Pro farebbe da «orchestratore» con Flash come sotto-agenti, e che 3.5 ha salvaguardie rafforzate in ambito cyber e CBRN[1]
Caratteristiche principali
- Terminal-bench 2.1 76,2% (3 Flash 58,0%), SWE-Bench Pro 55,1% e OSWorld-Verified 78,4% per l'uso del computer[3]
- MCP Atlas 83,6%, GDPval-AA 1656 Elo per il lavoro di conoscenza, CharXiv Reasoning 84,2% e ARC-AGI-2 72,1%[3]
- Può funzionare in autonomia per più ore, fermandosi a chiedere input nei punti decisionali[1]
Benchmark[3]
| Benchmark | Gemini 3.5 Flash | Gemini 3 Flash | Gemini 3.1 Pro | Claude Sonnet 4.6 | Claude Opus 4.7 | GPT-5.5 |
|---|---|---|---|---|---|---|
| Terminal-bench 2.1 (Programmazione agentica da terminale, harness Terminus-2) | 76,2% | 58,0% | 70,3% | — | 66,1% | 78,2% |
| SWE-Bench Pro (Public) (Compiti vari di programmazione agentica, tentativo singolo) | 55,1% | 49,6% | 54,2% | — | 64,3% | 58,6% |
| MCP Atlas (Flussi di lavoro in più passaggi con MCP) | 83,6% | 62,0% | 78,2% | 69,5% | 79,1% | 75,3% |
| Toolathlon (Uso generale di strumenti nel mondo reale) | 56,5% | 49,4% | — | — | — | 55,6% |
| OSWorld-Verified (Uso agentico del computer) | 78,4% | 65,1% | 76,2% | 72,5% | 78,0% | 78,7% |
| Finance Agent v2 (Analisi finanziaria e processo decisionale) | 57,9% | 42,6% | 43,0% | 51,0% | 51,5% | 51,8% |
| GDPval-AA (Lavoro di conoscenza economicamente rilevante, Elo) | 1656 | 1204 | 1314 | 1676 | 1753 | 1769 |
| CharXiv Reasoning (Sintesi di informazioni da grafici complessi, senza strumenti) | 84,2% | 80,3% | 83,3% | 72,4% | 82,1% | 84,1% |
| MMMU-Pro (Comprensione e ragionamento multimodali, senza strumenti) | 83,6% | 81,2% | 80,5% | 74,5% | 75,2% | 81,2% |
| Blueprint-Bench 2 (Ragionamento spaziale agentico, punteggio normalizzato) | 33,6% | 0,0% | 26,5% | 6,7% | 24,5% | 36,2% |
| MRCR v2 (8-needle) (Prestazioni su contesto lungo, 128k (media)) | 77,3% | 67,2% | 84,9% | 84,9% | 59,3% | 94,8% |
| MRCR v2 (8-needle) (Prestazioni su contesto lungo, 1M (puntuale)) | 26,6% | 22,1% | 26,3% | — | — | — |
| Humanity’s Last Exam (Ragionamento accademico (set completo, testo + MM)) | 40,2% | 33,7% | 44,4% | 33,2% | 46,9% | 41,4% |
| ARC-AGI-2 (Rompicapi di ragionamento astratto) | 72,1% | 33,6% | 77,1% | 58,3% | 75,8% | 84,6% |
Fonti 3AFFIDABILITÀ 85%Affidabilità complessiva: 85%Quanto la fonte e le altre fonti del pin ne confermano le date.Media ponderata di quanto 3 fonti, compresa quella principale, confermano gli orari di inizio e fine del pin; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recenteMostra tutti i pin con affidabilità pari o superiore al 75%
La prima voce è sempre la fonte del pin. L’affidabilità complessiva è una media ponderata di quanto ogni fonte conferma gli orari di inizio e fine indicati sopra; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recente.
- [1]90%techcrunch.com/2026/05/19/with-gemini-3-5-flash-google-bets-its-next-ai-wave-on-agents-not-chatbotstechcrunch.com· Postato il 30 set 2026· Inizio 19 mag 2026· 39% del punteggio
TechCrunch riporta che Google ha lanciato Gemini 3.5 Flash martedì 19 maggio 2026 alla sua conferenza annuale per sviluppatori I/O; la scheda del modello di Google DeepMind[3] per 3.5 Flash è pubblicata lo stesso giorno.
- [2]75%Gemini (language model) - Wikipediaen.wikipedia.org· Aggiunto il 30 set 2026· 39% del punteggio
The Wikipedia article lists Gemini 3.5 Flash as released on 19 May 2026, based on Gemini 3 Flash.
- [3]95%Gemini 3.5 Flash - Model Carddeepmind.google· Pubblicato il 19 mag 2026· Inizio 19 mag 2026 ✓· 23% del punteggio
DeepMind's model card, published 19 May 2026, gives the benchmark results against Gemini 3 Flash, 3.1 Pro, Claude Sonnet 4.6, Claude Opus 4.7 and GPT-5.5.
Suggerisci una correzione
Manca qualcosa o c’è un errore? Dillo con parole tue: un link che conferma questo pin, una data di inizio o fine diversa e perché, o un fatto che manca o è sbagliato. L’IA lo confronta con le fonti del pin, ne cerca di migliori e aggiunge qualsiasi pagina ti dia ragione. Le fonti del pin contano comunque di più. Anche un’immagine che mostra altro, o lo mostra male, viene esaminata e spostata in basso o sostituita.