- शुरुआत
- 19 फ़र॰ 202690% कॉन्फ़िडेंससोर्स से
Gemini 3.1 Pro जारी
मूल भाषा से अपने आप अनुवादित
मूल शीर्षक: Gemini 3.1 Pro Released
- Google ने 19 फरवरी 2026 को Gemini 3.1 Pro प्रीव्यू में जारी किया, यानी Gemini 3 Pro के तीन महीने बाद, और इसे हाल की विज्ञान व शोध सफलताओं के पीछे की उन्नत कोर इंटेलिजेंस बताया[1]
- यह “जटिल समस्याओं के समाधान के लिए अधिक स्मार्ट और सक्षम आधार” है, और ARC-AGI-2 पर, जो बिल्कुल नए तर्क पैटर्न परखता है, इसका सत्यापित स्कोर 77.1% है[1]
- Google ने इसे प्रीव्यू में रखा ताकि अपडेट्स की पुष्टि हो सके और सामान्य उपलब्धता से पहले एजेंटिक वर्कफ़्लो बेहतर हों, जो “जल्द” आने वाली है[1]
प्रमुख विशेषताएं
- Gemini ऐप में Google AI Pro और Ultra प्लान के लिए ऊंची सीमाओं के साथ उपलब्ध, और NotebookLM में केवल Pro व Ultra यूज़र्स के लिए[1]
- डेवलपर्स और एंटरप्राइज़ को यह AI Studio, Antigravity और Vertex AI में Gemini API के जरिए, तथा Gemini Enterprise में प्रीव्यू के रूप में मिलता है[1]
- Google के डेमो में यह इंटरैक्टिव 3D स्टारलिंग झुंड का कोड लिखता है, जिसे यूज़र हैंड ट्रैकिंग से नियंत्रित करते हैं और जो जनरेटिव संगीत बजाता है[1]
बेंचमार्क[3]
| बेंचमार्क | Gemini 3.1 Pro | Gemini 3 Pro | Sonnet 4.6 | Opus 4.6 | GPT-5.2 | GPT-5.3-Codex |
|---|---|---|---|---|---|---|
| Humanity's Last Exam (अकादमिक तर्क, पूरा सेट, टेक्स्ट + मल्टीमॉडल, बिना टूल्स) | 44.4% | 37.5% | 33.2% | 40.0% | 34.5% | — |
| Humanity's Last Exam (अकादमिक तर्क, पूरा सेट, टेक्स्ट + मल्टीमॉडल, Search (ब्लॉकलिस्ट) + कोड) | 51.4% | 45.8% | 49.0% | 53.1% | 45.5% | — |
| ARC-AGI-2 (अमूर्त तर्क पहेलियां, ARC Prize द्वारा सत्यापित) | 77.1% | 31.1% | 58.3% | 68.8% | 52.9% | — |
| GPQA Diamond (वैज्ञानिक ज्ञान, बिना टूल्स) | 94.3% | 91.9% | 89.9% | 91.3% | 92.4% | — |
| Terminal-Bench 2.0 (एजेंटिक टर्मिनल कोडिंग, Terminus-2 हार्नेस) | 68.5% | 56.9% | 59.1% | 65.4% | 54.0% | 64.7% |
| Terminal-Bench 2.0 (एजेंटिक टर्मिनल कोडिंग, अन्य सर्वश्रेष्ठ स्व-रिपोर्टेड हार्नेस) | — | — | — | — | 62.2% | 77.3% |
| SWE-Bench Verified (एजेंटिक कोडिंग, एकल प्रयास) | 80.6% | 76.2% | 79.6% | 80.8% | 80.0% | — |
| SWE-Bench Pro (Public) (विविध एजेंटिक कोडिंग कार्य, एकल प्रयास) | 54.2% | 43.3% | — | — | 55.6% | 56.8% |
| LiveCodeBench Pro (Codeforces, ICPC और IOI की प्रतिस्पर्धी कोडिंग समस्याएं, Elo) | 2887 | 2439 | — | — | 2393 | — |
| SciCode (वैज्ञानिक शोध कोडिंग) | 59% | 56% | 47% | 52% | 52% | — |
| APEX-Agents (लंबी अवधि के पेशेवर कार्य) | 33.5% | 18.4% | — | 29.8% | 23.0% | — |
| GDPval-AA Elo (विशेषज्ञ कार्य) | 1317 | 1195 | 1633 | 1606 | 1462 | — |
| τ2-bench (एजेंटिक और टूल उपयोग, रिटेल) | 90.8% | 85.3% | 91.7% | 91.9% | 82.0% | — |
| τ2-bench (एजेंटिक और टूल उपयोग, टेलीकॉम) | 99.3% | 98.0% | 97.9% | 99.3% | 98.7% | — |
| MCP Atlas (MCP का उपयोग करने वाले बहु-चरणीय वर्कफ़्लो) | 69.2% | 54.1% | 61.3% | 59.5% | 60.6% | — |
| BrowseComp (एजेंटिक खोज, Search + Python + Browse) | 85.9% | 59.2% | 74.7% | 84.0% | 65.8% | — |
| MMMU-Pro (मल्टीमॉडल समझ और तर्क, बिना टूल्स) | 80.5% | 81.0% | 74.5% | 73.9% | 79.5% | — |
| MMMLU (बहुभाषी प्रश्नोत्तर) | 92.6% | 91.8% | 89.3% | 91.1% | 89.6% | — |
| MRCR v2 (8-needle) (लंबे कॉन्टेक्स्ट का प्रदर्शन, 128k (औसत)) | 84.9% | 77.0% | 84.9% | 84.0% | 83.8% | — |
| MRCR v2 (8-needle) (लंबे कॉन्टेक्स्ट का प्रदर्शन, 1M (पॉइंटवाइज़)) | 26.3% | 26.3% | — | — | — | — |
संदर्भ 385% कॉन्फ़िडेंसकुल भरोसा: 85%पिन का स्रोत और संदर्भ उसकी तारीखों की कितनी पुष्टि करते हैं।सोर्स सहित 3 संदर्भ पिन के शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करते हैं, इसका भारित औसत; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है75% या उससे बेहतर कॉन्फ़िडेंस वाले सभी पिन दिखाएं
पहली एंट्री हमेशा पिन का सोर्स होती है। कुल कॉन्फ़िडेंस एक भारित औसत है कि हर संदर्भ ऊपर इस्तेमाल किए गए शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करता है; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है।
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-1-problog.google· 30 सित॰ 2026 को पोस्ट किया गया· शुरुआत 19 फ़र॰ 2026 ✓· स्कोर का 41%
Google की पोस्ट “Gemini 3.1 Pro: A smarter model for your most complex tasks” पर 19 फरवरी 2026 की तारीख है और उसमें कहा गया है कि यह उसी दिन डेवलपर्स, एंटरप्राइज़ और आम यूज़र्स के लिए रोल आउट हो रहा है।
- [2]75%Gemini (language model) - Wikipediaen.wikipedia.org· 30 सित॰ 2026 को जोड़ा गया· स्कोर का 41%
The Wikipedia article lists Gemini 3.1 Pro as released in preview on 19 February 2026.
- [3]95%Gemini 3.1 Pro - Model Carddeepmind.google· 19 फ़र॰ 2026 को प्रकाशित· स्कोर का 17%
DeepMind's model card gives the benchmark table against the model's predecessor and named rivals.
सुधार सुझाएं
कुछ छूट गया या गलत है? अपने शब्दों में बताएं: कोई लिंक जो इस पिन का समर्थन करता हो, कोई अलग शुरुआत या खत्म होने की तारीख और उसकी वजह, या कोई तथ्य जो छूट गया हो या गलत हो। AI इसे इस पिन के सोर्स से मिलाकर जांचता है, बेहतर सोर्स खोजता है, और जो भी पेज आपकी बात का समर्थन करता है उसे जोड़ देता है। पिन के अपने सोर्स की अहमियत फिर भी सबसे ज़्यादा रहती है। AI तस्वीरें भी देखता है: जो तस्वीर कुछ और दिखाती हो या ठीक से न दिखाती हो, उसे नीचे कर दिया जाता है या बदल दिया जाता है।