- Début
- 19 mai 2026CONFIANCE 95 %selon deepmind.google
Sortie de Gemini 3.5 Flash
Traduit automatiquement de l’original
Titre original: Gemini 3.5 Flash Released
- Google a lancé Gemini 3.5 Flash le 19 mai 2026 lors de Google I/O, qu'il présente comme son modèle le plus puissant à ce jour pour la programmation et les agents autonomes[1]
- Koray Kavukcuoglu a affirmé qu'il « surpasse notre dernier modèle de pointe, 3.1 Pro, sur presque tous les benchmarks », qu'il est 4x plus rapide que les autres modèles de pointe, et qu'une version optimisée est 12x plus rapide à qualité égale[1]
- Il a été co-développé avec Google Antigravity ; lors d'une démonstration, des agents ont été lancés pour construire un système d'exploitation complet à partir de zéro, et Google a publié le même jour Antigravity 2.0, une application de bureau autonome[1]
- Google a indiqué qu'un futur 3.5 Pro jouerait le rôle d'« orchestrateur » avec Flash comme sous-agents, et que 3.5 dispose de protections renforcées contre les risques cyber et CBRN[1]
Principales caractéristiques
- Terminal-bench 2.1 76.2% (3 Flash 58.0%), SWE-Bench Pro 55.1% et OSWorld-Verified 78.4% pour l'utilisation d'un ordinateur[3]
- MCP Atlas 83.6%, GDPval-AA 1656 Elo pour le travail de connaissance, CharXiv Reasoning 84.2% et ARC-AGI-2 72.1%[3]
- Peut fonctionner de façon autonome pendant plusieurs heures, en s'arrêtant pour demander une consigne aux points de décision[1]
Benchmarks[3]
| Benchmark | Gemini 3.5 Flash | Gemini 3 Flash | Gemini 3.1 Pro | Claude Sonnet 4.6 | Claude Opus 4.7 | GPT-5.5 |
|---|---|---|---|---|---|---|
| Terminal-bench 2.1 (programmation agentique en terminal, harnais Terminus-2) | 76.2% | 58.0% | 70.3% | — | 66.1% | 78.2% |
| SWE-Bench Pro (Public) (tâches de programmation agentique variées, une seule tentative) | 55.1% | 49.6% | 54.2% | — | 64.3% | 58.6% |
| MCP Atlas (flux de travail en plusieurs étapes avec MCP) | 83.6% | 62.0% | 78.2% | 69.5% | 79.1% | 75.3% |
| Toolathlon (usage d'outils généraliste en conditions réelles) | 56.5% | 49.4% | — | — | — | 55.6% |
| OSWorld-Verified (utilisation agentique d'un ordinateur) | 78.4% | 65.1% | 76.2% | 72.5% | 78.0% | 78.7% |
| Finance Agent v2 (analyse financière et aide à la décision) | 57.9% | 42.6% | 43.0% | 51.0% | 51.5% | 51.8% |
| GDPval-AA (travail de connaissance à forte valeur économique, Elo) | 1656 | 1204 | 1314 | 1676 | 1753 | 1769 |
| CharXiv Reasoning (synthèse d'informations à partir de graphiques complexes, sans outils) | 84.2% | 80.3% | 83.3% | 72.4% | 82.1% | 84.1% |
| MMMU-Pro (compréhension et raisonnement multimodaux, sans outils) | 83.6% | 81.2% | 80.5% | 74.5% | 75.2% | 81.2% |
| Blueprint-Bench 2 (raisonnement spatial agentique, score normalisé) | 33.6% | 0.0% | 26.5% | 6.7% | 24.5% | 36.2% |
| MRCR v2 (8-needle) (performance en contexte long, 128k (moyenne)) | 77.3% | 67.2% | 84.9% | 84.9% | 59.3% | 94.8% |
| MRCR v2 (8-needle) (performance en contexte long, 1M (ponctuel)) | 26.6% | 22.1% | 26.3% | — | — | — |
| Humanity’s Last Exam (raisonnement académique (jeu complet, texte + MM)) | 40.2% | 33.7% | 44.4% | 33.2% | 46.9% | 41.4% |
| ARC-AGI-2 (puzzles de raisonnement abstrait) | 72.1% | 33.6% | 77.1% | 58.3% | 75.8% | 84.6% |
Références 3CONFIANCE 85 %Confiance globale: 85%Dans quelle mesure la source et les références du pin étayent ses dates.Moyenne pondérée de la fermeté avec laquelle 3 références, source comprise, étayent les heures de début et de fin de l’épingle ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récenteAfficher toutes les épingles à 75 % de confiance ou plus
La première entrée est toujours la source de l’épingle. La confiance globale est une moyenne pondérée de la fermeté avec laquelle chaque référence étaye les heures de début et de fin retenues ci-dessus ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récente.
- [1]90%techcrunch.com/2026/05/19/with-gemini-3-5-flash-google-bets-its-next-ai-wave-on-agents-not-chatbotstechcrunch.com· Publié le 30 sept. 2026· Début 19 mai 2026· 39 % du score
TechCrunch rapporte que Google a lancé Gemini 3.5 Flash le mardi 19 mai 2026 lors de sa conférence annuelle pour développeurs I/O ; la fiche modèle de Google DeepMind[3] pour 3.5 Flash est publiée le même jour.
- [2]75%Gemini (language model) - Wikipediaen.wikipedia.org· Ajouté le 30 sept. 2026· 39 % du score
The Wikipedia article lists Gemini 3.5 Flash as released on 19 May 2026, based on Gemini 3 Flash.
- [3]95%Gemini 3.5 Flash - Model Carddeepmind.google· Publié le 19 mai 2026· Début 19 mai 2026 ✓· 23 % du score
DeepMind's model card, published 19 May 2026, gives the benchmark results against Gemini 3 Flash, 3.1 Pro, Claude Sonnet 4.6, Claude Opus 4.7 and GPT-5.5.
Suggérer une correction
Il manque quelque chose ou une erreur s'est glissée ? Dites-le avec vos mots : un lien qui étaye cette épingle, une autre date de début ou de fin et pourquoi, ou une information absente ou erronée. L'IA la vérifie au regard des sources de l'épingle, en cherche de meilleures et ajoute toute page qui vous donne raison. Les sources de l'épingle restent celles qui comptent le plus. L'IA regarde aussi les images : une image qui montre autre chose, ou qui le montre mal, passe en dernier ou est remplacée.