- Beginn
- 13. Aug. 202695 % SICHERHEITlaut deepmind.google
Gemini 3.7 Flash veröffentlicht
Automatisch aus dem Original übersetzt
Originaltitel: Gemini 3.7 Flash Released
- Google startete Gemini 3.7 Flash am 13. August 2026, nur drei Wochen nach 3.6 Flash, und nannte es ein „direktes Ergebnis von Entwicklerfeedback und algorithmischen Innovationen“[1]
- Es erzielt „starke Zugewinne“ gegenüber 3.6 Flash bei Fehlersuche und Problemlösung: DeepSWE v1.1 steigt von 49.0% auf 65.3% und FrontierCode 1.1 Main von 34.4% auf 43.6%[1]
- In der Gemini-App wurde es zuerst in Spark für Abonnenten von AI Pro und Ultra ausgerollt[1]
Wichtige Merkmale
- Einführungspreis von $0.75 pro Million Eingabe-Token und $3.75 pro Million Ausgabe-Token bis Ende 2026, halb so viel wie der Startpreis von 3.6 Flash[1][2]
- WebDev Arena Elo 1588 (3.6 Flash 1538); Dokumentenverständnis GDP.pdf 34.0% vs 22.0%; AutomationBench 30.4% vs 17.0%[1]
- Terminal-bench 2.1 85.8%, OSWorld-2.0 47.9% und ein Artificial Analysis Intelligence Index von 56[2]
- Aktualisierte Schutzmaßnahmen gegen den Missbrauch für chemische, biologische, radiologische und nukleare Zwecke sowie gegen Cyberangriffe[1]
Benchmarks[2]
| Benchmark | Gemini 3.7 Flash | Gemini 3.6 Flash | Claude Sonnet 5 | GPT-5.6 Terra | Muse Spark 1.2 |
|---|---|---|---|---|---|
| Eingabepreis ($/1M Token) | $0.75* | $0.75* | $2.00 | $2.00 | $1.25 |
| Ausgabepreis ($/1M Token) | $3.75* | $3.75* | $10.00 | $12.00 | $4.25 |
| Artificial Analysis Intelligence Index (Zusammengesetzte Modellintelligenz) | 56 | 52 | 55 | 57 | 57 |
| FrontierCode 1.1 Main (Code-Qualität im Produktivbetrieb, Score) | 43.6% | 34.4% | 42.7% | 41.3% | — |
| DeepSWE v1.1 (Softwareentwicklung mit langem Horizont) | 65.3% | 48.6% | 53.8% | 69.6% | 54.9% |
| Code Arena (Webentwicklung, Elo) | 1588 | 1538 | 1541 | 1523 | 1535 |
| Terminal-bench 2.1 (Agentisches Programmieren im Terminal) | 85.8% | 78.0% | 80.4% | 87.4% | 82.9% |
| Terminal-bench 3.0 (Allgemeine Agentenfähigkeiten) | 14.9% | 5.4% | 14.6% | 20.8% | — |
| AutomationBench (Workflow-Automatisierung in Unternehmen, privates Set) | 30.4% | 17.0% | 10.7% | 23.6% | — |
| GDPVal-AA v2 (Wissensarbeit, Elo) | 1525 | 1422 | 1598 | 1578 | 1628 |
| Harvey LAB-AA (Komplexe juristische Workflows) | 90.7% | 85.1% | 90.1% | 85.2% | — |
| GDP.pdf (Dokumentenverständnis auf Expertenniveau bei PDFs) | 34.0% | 22.0% | 28.0% | 24.7% | 16.0% |
| CharXiv Reasoning (Informationssynthese aus komplexen Diagrammen, ohne Werkzeuge) | 84.5% | 85.2% | 77.0% | 85.9% | — |
| CharXiv Reasoning (Informationssynthese aus komplexen Diagrammen, mit Werkzeugen) | 88.7% | 89.4% | 88.3% | — | — |
| LVBench (Verständnis langer Videos) | 85.4% | 84.2% | 68.5% | 78.9% | — |
| GDM-MRCR v2 (8-needle) (Leistung bei langem Kontext, 128k (Durchschnitt)) | 97.0% | 91.8% | 81.5% | 93.5% | — |
| OSWorld-2.0 (Agentische Computernutzung) | 47.9% | 33.8% | — | 50.2% | — |
| Agent's Last Exam (Multimodale Desktop- und Betriebssystem-Agentenaufgaben, Erfolgsquote) | 26.3% | 24.2% | 33.3% | 28.0% | — |
| HLE-Verified (Fachübergreifendes Expertenreasoning) | 53.6% | 51.2% | 31.0% | 51.1% | — |
| BioMysteryBench (Reasoning in der bioinformatischen Forschung, für Menschen lösbar) | 87.1% | 80.6% | 87.5% | 83.8% | — |
| BioMysteryBench (Reasoning in der bioinformatischen Forschung, für Menschen schwierig) | 43.5% | 41.2% | 34.1% | 49.4% | — |
| LABBench2 (Reale Forschungsaufgaben in der Biologie) | 82.1% | 76.1% | 80.1% | 81.2% | — |
Belege 292 % SICHERHEITGesamtvertrauen: 92%Wie gut die Quelle und die Belege des Pins seine Termine stützen.Gewichteter Durchschnitt, wie fest 2 Belege einschließlich der Quelle die Start- und Endzeiten des Pins stützen; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so vielAlle Pins mit mindestens 75 % Sicherheit anzeigen
Der erste Eintrag ist immer die Quelle des Pins. Die Gesamtsicherheit ist ein gewichteter Durchschnitt, wie fest jeder Beleg die oben verwendeten Start- und Endzeiten stützt; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so viel.
- [1]90%9to5google.com/2026/08/13/gemini-3-7-flash-launch9to5google.com· Gepostet am 30. Sept. 2026· Beginn 13. Aug. 2026· 55 % der Wertung
Der Startbericht von 9to5Google datiert vom 13. August 2026 und erklärt, Google habe „heute Gemini 3.7 Flash angekündigt“; die Modellkarte von DeepMind[2] erschien am 13. August 2026.
- [2]95%Gemini 3.7 Flash - Model Carddeepmind.google· Veröffentlicht am 13. Aug. 2026· Beginn 13. Aug. 2026 ✓· 45 % der Wertung
DeepMind's model card, published 13 August 2026, lists the introductory prices and a benchmark table against 3.6 Flash, Claude Sonnet 5, GPT-5.6 Terra and Muse Spark 1.2.
Korrektur vorschlagen
Fehlt etwas oder stimmt etwas nicht? Sag es in deinen eigenen Worten: ein Link, der diesen Pin belegt, ein anderes Start- oder Enddatum und warum, oder eine Angabe, die fehlt oder falsch ist. Die KI prüft es an den Quellen dieses Pins, sucht nach besseren und ergänzt jede Seite, die dich bestätigt. Die eigenen Quellen des Pins zählen weiterhin am meisten. Auch Bilder sieht sich die KI an: Eines, das etwas anderes oder die Sache schlecht zeigt, wird nach hinten gestellt oder ersetzt.