- Début
- 13 août 2026CONFIANCE 95 %selon deepmind.google
Sortie de Gemini 3.7 Flash
Traduit automatiquement de l’original
Titre original: Gemini 3.7 Flash Released
- Google a lancé Gemini 3.7 Flash le 13 août 2026, à peine trois semaines après 3.6 Flash, en le présentant comme le « résultat direct des retours des développeurs et d'innovations algorithmiques »[1]
- Il affiche de « fortes progressions » par rapport à 3.6 Flash en débogage et en résolution de tickets, avec DeepSWE v1.1 passant de 49.0% à 65.3% et FrontierCode 1.1 Main de 34.4% à 43.6%[1]
- Dans l'application Gemini, il a d'abord été déployé dans Spark, pour les abonnés AI Pro et Ultra[1]
Principales caractéristiques
- Prix de lancement de $0.75 par million de jetons en entrée et $3.75 par million de jetons en sortie jusqu'à la fin de 2026, soit la moitié du prix auquel 3.6 Flash avait été lancé[1][2]
- WebDev Arena Elo 1588 (3.6 Flash 1538) ; compréhension de documents GDP.pdf 34.0% contre 22.0% ; AutomationBench 30.4% contre 17.0%[1]
- Terminal-bench 2.1 85.8%, OSWorld-2.0 47.9% et un Artificial Analysis Intelligence Index de 56[2]
- Protections mises à jour contre les usages détournés à des fins chimiques, biologiques, radiologiques et nucléaires et contre l'offensive cyber[1]
Benchmarks[2]
| Benchmark | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra | Muse Spark 1.2 |
|---|---|---|---|---|---|
| Prix d'entrée ($/1M de jetons) | $0.75* | $0.75* | $2.00 | $2.00 | $1.25 |
| Prix de sortie ($/1M de jetons) | $3.75* | $3.75* | $10.00 | $12.00 | $4.25 |
| Artificial Analysis Intelligence Index (intelligence composite des modèles) | 56 | 52 | 55 | 57 | 57 |
| FrontierCode 1.1 Main (qualité du code en production, score) | 43.6% | 34.4% | 42.7% | 41.3% | — |
| DeepSWE v1.1 (génie logiciel de longue haleine) | 65.3% | 48.6% | 53.8% | 69.6% | 54.9% |
| Code Arena (développement web, Elo) | 1588 | 1538 | 1541 | 1523 | 1535 |
| Terminal-bench 2.1 (programmation agentique en terminal) | 85.8% | 78.0% | 80.4% | 87.4% | 82.9% |
| Terminal-bench 3.0 (capacités d'agent généralistes) | 14.9% | 5.4% | 14.6% | 20.8% | — |
| AutomationBench (automatisation des flux de travail en entreprise, jeu privé) | 30.4% | 17.0% | 10.7% | 23.6% | — |
| GDPVal-AA v2 (travail de connaissance, Elo) | 1525 | 1422 | 1598 | 1578 | 1628 |
| Harvey LAB-AA (flux de travail juridiques complexes) | 90.7% | 85.1% | 90.1% | 85.2% | — |
| GDP.pdf (compréhension experte de documents PDF) | 34.0% | 22.0% | 28.0% | 24.7% | 16.0% |
| CharXiv Reasoning (synthèse d'informations à partir de graphiques complexes, sans outils) | 84.5% | 85.2% | 77.0% | 85.9% | — |
| CharXiv Reasoning (synthèse d'informations à partir de graphiques complexes, avec outils) | 88.7% | 89.4% | 88.3% | — | — |
| LVBench (compréhension de vidéos longues) | 85.4% | 84.2% | 68.5% | 78.9% | — |
| GDM-MRCR v2 (8-needle) (performance en contexte long, 128k (moyenne)) | 97.0% | 91.8% | 81.5% | 93.5% | — |
| OSWorld-2.0 (utilisation agentique d'un ordinateur) | 47.9% | 33.8% | — | 50.2% | — |
| Agent's Last Exam (tâches multimodales d'agent sur poste de travail et système d'exploitation, taux de réussite) | 26.3% | 24.2% | 33.3% | 28.0% | — |
| HLE-Verified (raisonnement expert multidisciplinaire) | 53.6% | 51.2% | 31.0% | 51.1% | — |
| BioMysteryBench (raisonnement en recherche bio-informatique, résolvable par un humain) | 87.1% | 80.6% | 87.5% | 83.8% | — |
| BioMysteryBench (raisonnement en recherche bio-informatique, difficile pour un humain) | 43.5% | 41.2% | 34.1% | 49.4% | — |
| LABBench2 (tâches de recherche biologique en conditions réelles) | 82.1% | 76.1% | 80.1% | 81.2% | — |
Références 2CONFIANCE 92 %Confiance globale: 92%Dans quelle mesure la source et les références du pin étayent ses dates.Moyenne pondérée de la fermeté avec laquelle 2 références, source comprise, étayent les heures de début et de fin de l’épingle ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récenteAfficher toutes les épingles à 75 % de confiance ou plus
La première entrée est toujours la source de l’épingle. La confiance globale est une moyenne pondérée de la fermeté avec laquelle chaque référence étaye les heures de début et de fin retenues ci-dessus ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récente.
- [1]90%9to5google.com/2026/08/13/gemini-3-7-flash-launch9to5google.com· Publié le 30 sept. 2026· Début 13 août 2026· 55 % du score
Le compte rendu de lancement de 9to5Google est daté du 13 août 2026 et indique que Google a « today announced Gemini 3.7 Flash » ; la fiche modèle de DeepMind[2] est publiée le 13 août 2026.
- [2]95%Gemini 3.7 Flash - Model Carddeepmind.google· Publié le 13 août 2026· Début 13 août 2026 ✓· 45 % du score
DeepMind's model card, published 13 August 2026, lists the introductory prices and a benchmark table against 3.6 Flash, Claude Sonnet 5, GPT-5.6 Terra and Muse Spark 1.2.
Suggérer une correction
Il manque quelque chose ou une erreur s'est glissée ? Dites-le avec vos mots : un lien qui étaye cette épingle, une autre date de début ou de fin et pourquoi, ou une information absente ou erronée. L'IA la vérifie au regard des sources de l'épingle, en cherche de meilleures et ajoute toute page qui vous donne raison. Les sources de l'épingle restent celles qui comptent le plus. L'IA regarde aussi les images : une image qui montre autre chose, ou qui le montre mal, passe en dernier ou est remplacée.