- Inizio
- 2 set 2026AFFIDABILITÀ 90%da la fonte
Google rilascia Gemini 3.8 Flash e 3.8 Flash Cyber
Tradotto automaticamente dall’originale
Titolo originale: Google Releases Gemini 3.8 Flash and 3.8 Flash Cyber
- Google ha presentato Gemini 3.8 Flash il 2 settembre 2026, tre settimane dopo 3.7 Flash e la sua terza release Flash in sei settimane, definendolo il suo miglior modello di ragionamento e programmazione finora, con la stessa velocità e lo stesso basso costo di 3.7[1]
- È stato lanciato insieme a Gemini 3.8 Flash Cyber, il modello di cybersicurezza più capace di Google per il rilevamento di vulnerabilità e la correzione automatizzata, disponibile solo per difensori fidati tramite il nuovo Fairwind Program perché viene distribuito con mitigazioni cyber più permissive[1]
- Il Fairwind Program abbina Gemini 3.8 Flash Cyber all'harness CodeMender di Google per governi e autorità nazionali per la cybersicurezza, gestori di infrastrutture critiche e piattaforme tecnologiche di base, e Google dice di avere più di 650 partner partecipanti[4]
- Gemini 3.8 Flash è arrivato agli abbonati Google AI Pro e Ultra nell'app Gemini, in AI Mode nella Ricerca e in Gemini in Google Sheets, agli sviluppatori in Google Antigravity, AI Studio e nell'API Gemini, e alle aziende in Gemini Enterprise[1][5]
- Il lancio è arrivato mentre le azioni di Google chiudevano una serie negativa di quattro mesi, la più lunga dal 2015; il titolo è salito dello 0,6% nella giornata, e Gil Luria di D.A. Davidson ha detto che il modello tiene Google in corsa ma probabilmente lo lascia a una grande distanza al terzo posto nel mercato enterprise[6]
- Google ha fatto seguire il 15 settembre Gemini 3.8 Live e 3.8 Live Extended Thinking, i suoi modelli vocali dal vivo[3]
Caratteristiche principali
- Prezzo introduttivo di $0,75 per milione di token in input e $3,75 per milione di token in output, lo stesso di 3.7 Flash, fino al 31 dicembre 2026; dal 1° gennaio 2027 sale a $1,50 e $7,50[1]
- Una finestra di contesto da 1.048.576 token e 65.536 token massimi in output, input di testo, immagini, audio e video con output di testo, e livelli di ragionamento LOW, MEDIUM (predefinito) e HIGH, senza livello MINIMAL[2]
- Benchmark nella tabella di Google: 73,7% su DeepSWE v1.1 contro il 65,3% di 3.7 Flash, 54,9% su HLE-Verified, 61,4% su Vals Finance Agent v2 e 89,4% su Terminal-bench 2.1[1]
- Progettato per lavorare di più, compiendo passaggi di ragionamento aggiuntivi e chiamando strumenti in modo iterativo, quindi può usare più token a livelli di impegno più alti[1]
- Data di aggiornamento delle conoscenze a marzo 2026 per alcuni ambiti e a gennaio 2025 per altri[5]
- Flash Cyber supera il 70% di successo sul benchmark interno di Google sulle vulnerabilità in 20 linguaggi, ottiene il 47,2% pass@1 su CWE-Bench e ha fornito al team Chrome Security 2,6 volte più correzioni corrette rispetto a modelli commerciali molto più grandi[1]
Benchmark[7]
| Benchmark | Gemini 3.8 Flash | Gemini 3.7 Flash | Claude Opus 5 | Claude Sonnet 5 | GPT-5.6 Sol | GPT-5.6 Terra |
|---|---|---|---|---|---|---|
| Prezzo input ($/1M token, senza caching) | $0.75 | $0.75 | $5.00 | $2.00 | $4.00 | $2.00 |
| Prezzo output ($/1M token) | $3.75 | $3.75 | $25.00 | $10.00 | $20.00 | $12.00 |
| DeepSWE v1.1 (ingegneria del software a lungo orizzonte) | 73.7% | 65.3% | 74.0% | 53.8% | 72.7% | 69.6% |
| GDPVal-AA v2 (lavoro di conoscenza, Elo) | 1545 | 1482 | 1824 | 1584 | 1710 | 1528 |
| Vals Finance Agent v2 (attività da analista finanziario) | 61.4% | 59.0% | 58.6% | 53.9% | 53.8% | 54.4% |
| Harvey's Legal Agent Benchmark (flussi di lavoro legali complessi, tasso di successo complessivo) | 10.0% | 8.8% | 6.7% | 5.0% | 2.5% | 0.8% |
| Terminal-bench 2.1 (programmazione agentica da terminale) | 89.4% | 85.8% | 89.1% | 80.4% | 88.8% | 87.4% |
| Terminal-bench 4.0 (capacità generali degli agenti) | 19.1% | 11.2% | 51.8% | 12.4% | 37.3% | 23.6% |
| GDP.PDF (comprensione esperta di documenti PDF, tasso di successo complessivo) | 35.0% | 34.0% | 37.0% | 28.0% | 40.0% | 29.0% |
| CharXiv Reasoning (sintesi di informazioni da grafici complessi, senza strumenti) | 86.2% | 84.5% | 83.7% | 70.1% | 85.8% | 85.9% |
| LVBench (comprensione di video lunghi) | 87.8% | 85.4% | 75.4% | 68.5% | 82.1% | 78.9% |
| LVBench (comprensione di video lunghi) | 87.1% | 85.4% | 75.4% | 68.5% | 82.1% | 78.9% |
| HLE-Verified (ragionamento esperto multidisciplinare) | 54.9% | 53.6% | 54.4% | 31.0% | 54.5% | 51.1% |
| OSWorld-2.0 (uso agentico del computer, strumento di scorebatch parziale abilitato) | 59.0% | 50.6% | 75.4% | 42.6% | 62.6% | 50.2% |
| BioMysteryBench (flussi di lavoro di ricerca bioinformatica, risolvibili da un umano) | 88.8% | 87.1% | 90.1% | 87.5% | 79.5% | 83.8% |
| BioMysteryBench (flussi di lavoro di ricerca bioinformatica, difficili per un umano) | 56.5% | 43.5% | 49.4% | 34.1% | 44.7% | 49.4% |
| LABBench2 (attività di ricerca biologica nel mondo reale) | 86.2% | 82.1% | 84.2% | 80.1% | 82.1% | 81.2% |
Fonti 7AFFIDABILITÀ 89%Affidabilità complessiva: 89%Quanto la fonte e le altre fonti del pin ne confermano le date.Media ponderata di quanto 7 fonti, compresa quella principale, confermano gli orari di inizio e fine del pin; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recenteMostra tutti i pin con affidabilità pari o superiore al 75%
La prima voce è sempre la fonte del pin. L’affidabilità complessiva è una media ponderata di quanto ogni fonte conferma gli orari di inizio e fine indicati sopra; una fonte conta la metà per ogni 180 giorni in più rispetto alla più recente.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyberblog.google· Postato il 23 set 2026· Inizio 2 set 2026 ✓· 15% del punteggio
Il post di Google[2], datato Sep 02, 2026, dice «oggi presentiamo Gemini 3.8» e la CNBC[6] riporta che l'azienda «mercoledì ha lanciato Gemini 3.8 Flash».
- [2]95%Developer's guide to Gemini 3.8 Flash | Google Cloud Documentationdocs.cloud.google.com· Aggiunto il 23 set 2026· 15% del punteggio
Google Cloud's official developer guide gives the model's specifications: model ID gemini-3.8-flash, GA launch stage, 1,048,576-token context window, 65,536 max output tokens, and LOW/MEDIUM/HIGH thinking levels.
- [3]75%Introducing Gemini 3.8 Live and 3.8 Live Extended Thinkingblog.google· Pubblicato il 15 set 2026· 15% del punteggio
Google's[2] follow-up post of September 15, 2026 extending the 3.8 generation to its live voice models, Gemini 3.8 Live and 3.8 Live Extended Thinking.
- [4]90%Proactive cyber defense for governments and enterprisesblog.google· Pubblicato il 2 set 2026· 14% del punteggio
Google's[2] same-day post launching the Fairwind Program, which gives governments, critical infrastructure operators and core technology platforms access to Gemini 3.8 Flash Cyber with the CodeMender harness.
- [5]90%Gemini 3.8 Flash rolling out three weeks after last release9to5google.com· Pubblicato il 2 set 2026· 14% del punteggio
Independent same-day report that Google[2] is rolling out Gemini 3.8 Flash today, with its knowledge cutoff, introductory pricing until December 31, availability and the Flash Cyber model.
Suggerisci una correzione
Manca qualcosa o c’è un errore? Dillo con parole tue: un link che conferma questo pin, una data di inizio o fine diversa e perché, o un fatto che manca o è sbagliato. L’IA lo confronta con le fonti del pin, ne cerca di migliori e aggiunge qualsiasi pagina ti dia ragione. Le fonti del pin contano comunque di più. Anche un’immagine che mostra altro, o lo mostra male, viene esaminata e spostata in basso o sostituita.