- शुरुआत
- 19 मई 202695% कॉन्फ़िडेंसdeepmind.google से
Gemini 3.5 Flash जारी
मूल भाषा से अपने आप अनुवादित
मूल शीर्षक: Gemini 3.5 Flash Released
- Google ने 19 मई 2026 को Google I/O में Gemini 3.5 Flash लॉन्च किया, जिसे वह कोडिंग और स्वायत्त एजेंट्स के लिए अपना अब तक का सबसे मजबूत मॉडल बताता है[1]
- कोरे कवुकचुओग्लू ने कहा कि यह “लगभग सभी बेंचमार्क पर हमारे नवीनतम फ्रंटियर मॉडल 3.1 Pro से बेहतर प्रदर्शन करता है”, अन्य फ्रंटियर मॉडलों से 4 गुना तेज है, और इसका ऑप्टिमाइज़्ड संस्करण उसी गुणवत्ता पर 12 गुना तेज है[1]
- इसे Google Antigravity के साथ मिलकर विकसित किया गया, और एक डेमो में एजेंट्स ने शुरू से पूरा ऑपरेटिंग सिस्टम बनाया; उसी दिन Google ने स्टैंड-अलोन डेस्कटॉप ऐप Antigravity 2.0 भी जारी किया[1]
- Google ने कहा कि आने वाला 3.5 Pro “ऑर्केस्ट्रेटर” के रूप में काम करेगा और Flash सब-एजेंट्स होंगे, तथा 3.5 में साइबर और CBRN सुरक्षा उपाय मजबूत किए गए हैं[1]
प्रमुख विशेषताएं
- Terminal-bench 2.1 पर 76.2% (3 Flash का 58.0%), SWE-Bench Pro पर 55.1%, और कंप्यूटर उपयोग के लिए OSWorld-Verified पर 78.4%[3]
- MCP Atlas पर 83.6%, ज्ञान-कार्य के लिए GDPval-AA पर 1656 Elo, CharXiv Reasoning पर 84.2% और ARC-AGI-2 पर 72.1%[3]
- कई घंटों तक स्वायत्त रूप से चल सकता है और निर्णय के मोड़ पर इनपुट के लिए रुक जाता है[1]
बेंचमार्क[3]
| बेंचमार्क | Gemini 3.5 Flash | Gemini 3 Flash | Gemini 3.1 Pro | Claude Sonnet 4.6 | Claude Opus 4.7 | GPT-5.5 |
|---|---|---|---|---|---|---|
| Terminal-bench 2.1 (एजेंटिक टर्मिनल कोडिंग, Terminus-2 हार्नेस) | 76.2% | 58.0% | 70.3% | — | 66.1% | 78.2% |
| SWE-Bench Pro (Public) (विविध एजेंटिक कोडिंग कार्य, एकल प्रयास) | 55.1% | 49.6% | 54.2% | — | 64.3% | 58.6% |
| MCP Atlas (MCP का उपयोग करने वाले बहु-चरणीय वर्कफ़्लो) | 83.6% | 62.0% | 78.2% | 69.5% | 79.1% | 75.3% |
| Toolathlon (वास्तविक दुनिया में सामान्य टूल उपयोग) | 56.5% | 49.4% | — | — | — | 55.6% |
| OSWorld-Verified (एजेंटिक कंप्यूटर उपयोग) | 78.4% | 65.1% | 76.2% | 72.5% | 78.0% | 78.7% |
| Finance Agent v2 (वित्तीय विश्लेषण और निर्णय लेना) | 57.9% | 42.6% | 43.0% | 51.0% | 51.5% | 51.8% |
| GDPval-AA (आर्थिक रूप से मूल्यवान ज्ञान-कार्य, Elo) | 1656 | 1204 | 1314 | 1676 | 1753 | 1769 |
| CharXiv Reasoning (जटिल चार्ट से जानकारी का संश्लेषण, बिना टूल्स) | 84.2% | 80.3% | 83.3% | 72.4% | 82.1% | 84.1% |
| MMMU-Pro (मल्टीमॉडल समझ और तर्क, बिना टूल्स) | 83.6% | 81.2% | 80.5% | 74.5% | 75.2% | 81.2% |
| Blueprint-Bench 2 (एजेंटिक स्थानिक तर्क, सामान्यीकृत स्कोर) | 33.6% | 0.0% | 26.5% | 6.7% | 24.5% | 36.2% |
| MRCR v2 (8-needle) (लंबे कॉन्टेक्स्ट का प्रदर्शन, 128k (औसत)) | 77.3% | 67.2% | 84.9% | 84.9% | 59.3% | 94.8% |
| MRCR v2 (8-needle) (लंबे कॉन्टेक्स्ट का प्रदर्शन, 1M (पॉइंटवाइज़)) | 26.6% | 22.1% | 26.3% | — | — | — |
| Humanity’s Last Exam (अकादमिक तर्क, पूरा सेट, टेक्स्ट + मल्टीमॉडल) | 40.2% | 33.7% | 44.4% | 33.2% | 46.9% | 41.4% |
| ARC-AGI-2 (अमूर्त तर्क पहेलियां) | 72.1% | 33.6% | 77.1% | 58.3% | 75.8% | 84.6% |
संदर्भ 385% कॉन्फ़िडेंसकुल भरोसा: 85%पिन का स्रोत और संदर्भ उसकी तारीखों की कितनी पुष्टि करते हैं।सोर्स सहित 3 संदर्भ पिन के शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करते हैं, इसका भारित औसत; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है75% या उससे बेहतर कॉन्फ़िडेंस वाले सभी पिन दिखाएं
पहली एंट्री हमेशा पिन का सोर्स होती है। कुल कॉन्फ़िडेंस एक भारित औसत है कि हर संदर्भ ऊपर इस्तेमाल किए गए शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करता है; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है।
- [1]90%techcrunch.com/2026/05/19/with-gemini-3-5-flash-google-bets-its-next-ai-wave-on-agents-not-chatbotstechcrunch.com· 30 सित॰ 2026 को पोस्ट किया गया· शुरुआत 19 मई 2026· स्कोर का 39%
TechCrunch के अनुसार Google ने मंगलवार 19 मई 2026 को अपने वार्षिक I/O डेवलपर सम्मेलन में Gemini 3.5 Flash लॉन्च किया; Google DeepMind[3] का 3.5 Flash मॉडल कार्ड उसी दिन प्रकाशित हुआ।
- [2]75%Gemini (language model) - Wikipediaen.wikipedia.org· 30 सित॰ 2026 को जोड़ा गया· स्कोर का 39%
The Wikipedia article lists Gemini 3.5 Flash as released on 19 May 2026, based on Gemini 3 Flash.
- [3]95%Gemini 3.5 Flash - Model Carddeepmind.google· 19 मई 2026 को प्रकाशित· शुरुआत 19 मई 2026 ✓· स्कोर का 23%
DeepMind's model card, published 19 May 2026, gives the benchmark results against Gemini 3 Flash, 3.1 Pro, Claude Sonnet 4.6, Claude Opus 4.7 and GPT-5.5.
सुधार सुझाएं
कुछ छूट गया या गलत है? अपने शब्दों में बताएं: कोई लिंक जो इस पिन का समर्थन करता हो, कोई अलग शुरुआत या खत्म होने की तारीख और उसकी वजह, या कोई तथ्य जो छूट गया हो या गलत हो। AI इसे इस पिन के सोर्स से मिलाकर जांचता है, बेहतर सोर्स खोजता है, और जो भी पेज आपकी बात का समर्थन करता है उसे जोड़ देता है। पिन के अपने सोर्स की अहमियत फिर भी सबसे ज़्यादा रहती है। AI तस्वीरें भी देखता है: जो तस्वीर कुछ और दिखाती हो या ठीक से न दिखाती हो, उसे नीचे कर दिया जाता है या बदल दिया जाता है।