- शुरुआत
- 30 सित॰ 202690% कॉन्फ़िडेंससोर्स से
Gemini 4 Argon की घोषणा
मूल भाषा से अपने आप अनुवादित
मूल शीर्षक: Gemini 4 Argon Announced
- Google ने 30 सितंबर 2026 को Gemini 4 Argon की घोषणा की और इसे वास्तविक दुनिया की सॉफ़्टवेयर इंजीनियरिंग, कानून और वित्त जैसे एंटरप्राइज़ ज्ञान-कार्य और साइबर सुरक्षा रक्षा के लिए अपना “नया फ्रंटियर मॉडल” बताया[1]
- यह पहले Fairwind Program के जरिए भरोसेमंद साइबर रक्षकों के एक समूह के लिए रोल आउट हो रहा है, और Google पहुंच धीरे-धीरे बढ़ाते हुए प्री-रिलीज़ मॉडल एक्सेस की अमेरिकी सरकार की स्वैच्छिक प्रक्रिया में हिस्सा ले रहा है[1]
- Google इसे डेवलपर्स, एंटरप्राइज़ और आम यूज़र्स के लिए “जितनी जल्दी हो सके” उपलब्ध कराएगा, शुरुआत सशुल्क API ग्राहकों और Google AI Ultra सब्सक्राइबर्स से होगी, यानी व्यापक रिलीज़ अभी बाकी है[1]
- आंतरिक रूप से यह पहले से Google के वर्कफ़्लो चला रहा है: एजेंट्स ने डेटा सेंटरों में 300 TiB से अधिक मेमोरी खाली की, क्वांटम-सबरूटीन बेसलाइन को 40% से पछाड़ा, और Fuchsia OS के Zircon कर्नल के लिए 800K+ लाइनों तक का C/C++ कोड Rust में माइग्रेट करने में मदद की[1]
- साइबर रक्षा के एक प्रदर्शन में इसने दुनिया भर के अस्पतालों में इस्तेमाल होने वाले हेल्थकेयर सॉफ़्टवेयर में एक गंभीर कमजोरी खोजी, जो पहले के फ्रंटियर मॉडलों से छूट गई थी[1]
प्रमुख विशेषताएं
- आउटपुट सीमा 64K से बढ़ाकर 10 लाख टोकन की गई, ताकि मॉडल एक ही प्रक्रिया में सैकड़ों हजार टोकन तक तर्क कर सके[1]
- परिचयात्मक कीमत $2 प्रति 10 लाख इनपुट टोकन और $10 प्रति 10 लाख आउटपुट टोकन, कैश्ड इनपुट 95% सस्ता; उसके बाद $4 और $20 प्रति 10 लाख[1]
- DeepSWE v1.1 पर 77.9% के साथ नया अत्याधुनिक स्तर (GPT-6 Astra 74.1%, Claude Opus 5.5 74.2%), और AutomationBench पर 51.3% तथा Vals Index पर 68.9% के साथ पहला स्थान[1][2]
- LVBench लंबे वीडियो की समझ में 91.7%, Vals Finance Agent v2 पर 65.4% और Harvey के Legal Agent Benchmark पर 19.6%[1][2]
- CWE-bench v1 कमजोरी सुधार में 68.0%, पहले स्थान पर बराबरी; Google इसे भरोसेमंद रक्षकों और अपनी टीमों के लिए साइबर गार्डरेल के बिना जारी करता है[1][2]
- सुरक्षा उपाय: वैध दोहरे उपयोग वाले विज्ञान को बनाए रखते हुए हानिकारक अनुरोधों से इनकार, Gray Swan के इनडायरेक्ट प्रॉम्प्ट इंजेक्शन बेंचमार्क पर शीर्ष स्कोर, सीमा से बाहर निष्पादन रोकने वाली चेन-ऑफ-थॉट और एक्शन मॉनिटरिंग, तथा मजबूत सैंडबॉक्स[1][2]
बेंचमार्क[2]
| बेंचमार्क | Gemini 4 Argon | GPT-6 Astra | Claude Fable 5.1 | Claude Opus 5.5 |
|---|---|---|---|---|
| Vals Index (ज्ञान-कार्य) | 68.9% | 63.1% | 65.8% | 67.0% |
| AutomationBench (ज्ञान-कार्य, स्कोर) | 51.3% | 41.4% | 31.4% | 42.5% |
| Vals Finance Agent v2 (ज्ञान-कार्य) | 65.4% | 53.5% | 58.9% | 58.6% |
| Harvey's Legal Agent Benchmark (ज्ञान-कार्य) | 19.6% | 5.4% | 6.7% | 3.8% |
| DeepSWE v1.1 (एजेंटिक कोडिंग) | 77.9% | 74.1% | 67.4% | 74.2% |
| FrontierSWE v2 (एजेंटिक कोडिंग) | 55.0% | 65.5% | 56.3% | 62.3% |
| Vibe Code Bench (एजेंटिक कोडिंग) | 91.9% | 89.6% | 90.3% | 90.3% |
| Terminal-bench 4.0 (एजेंटिक कोडिंग) | 57.4% | 58.2% | 57.9% | 66.4% |
| PostTrainBench (ML इंजीनियरिंग) | 45.3% | 44.3% | 40.2% | 49.3% |
| Terminal-Bench Science 0.1 (विज्ञान और गणित) | 57.6% | 68.1% | 52.6% | 63.3% |
| LABBench 2 (विज्ञान और गणित) | 88.8% | 85.4% | 68.6% | 73.1% |
| RiemannBench (विज्ञान और गणित) | 76.0% | 72.0% | 65.6% | 69.6% |
| GraphWalks (लंबा कॉन्टेक्स्ट, 128k तक, BFS (F1)) | 99.7% | 98.7% | 91.4% | 90.6% |
| GraphWalks (लंबा कॉन्टेक्स्ट, 256k से 1M, BFS (F1)) | 84.2% | 71.8% | 65.0% | 66.8% |
| Agent's Last Exam (कंप्यूटर उपयोग, पास दर) | 39.5% | 34.2% | — | 38.2% |
| OSWorld-2.0 (कंप्यूटर उपयोग, ऑफ़लाइन सबसेट आंशिक स्कोर) | 69.2% | 72.6% | — | — |
| Chartography (मल्टीमॉडल समझ) | 71.6% | 71.0% | 46.2% | 66.3% |
| LVBench (मल्टीमॉडल समझ) | 91.7% | 87.5% | 79.7% | 83.7% |
| CWE-bench v1 (साइबर सुरक्षा) | 68.0% | 68.0% | 58.0% | 67.0% |
संदर्भ 287% कॉन्फ़िडेंसकुल भरोसा: 87%पिन का स्रोत और संदर्भ उसकी तारीखों की कितनी पुष्टि करते हैं।सोर्स सहित 2 संदर्भ पिन के शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करते हैं, इसका भारित औसत; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है75% या उससे बेहतर कॉन्फ़िडेंस वाले सभी पिन दिखाएं
पहली एंट्री हमेशा पिन का सोर्स होती है। कुल कॉन्फ़िडेंस एक भारित औसत है कि हर संदर्भ ऊपर इस्तेमाल किए गए शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करता है; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है।
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argonblog.google· 30 सित॰ 2026 को पोस्ट किया गया· शुरुआत 30 सित॰ 2026 ✓· स्कोर का 50%
Google की पोस्ट “Gemini 4 Argon: our next era of frontier intelligence” पर 30 सितंबर 2026 की तारीख है और उसमें कहा गया है “Today, we're announcing our new frontier model, Gemini 4 Argon, which is rolling out to a set of trusted cyber defenders”; डेवलपर्स, एंटरप्राइज़ और आम यूज़र्स के लिए व्यापक उपलब्धता “जितनी जल्दी हो सके” आएगी (अनुमानित पिन 4810 देखें)।
- [2]85%Gemini - Google DeepMinddeepmind.google· 30 सित॰ 2026 को जोड़ा गया· शुरुआत 30 सित॰ 2026· स्कोर का 50%
DeepMind's Gemini page now leads with Gemini 4 Argon and carries its benchmark table against GPT-6 Astra, Claude Fable 5.1 and Claude Opus 5.5, plus the four safeguard areas Google is strengthening before broad availability.
सुधार सुझाएं
कुछ छूट गया या गलत है? अपने शब्दों में बताएं: कोई लिंक जो इस पिन का समर्थन करता हो, कोई अलग शुरुआत या खत्म होने की तारीख और उसकी वजह, या कोई तथ्य जो छूट गया हो या गलत हो। AI इसे इस पिन के सोर्स से मिलाकर जांचता है, बेहतर सोर्स खोजता है, और जो भी पेज आपकी बात का समर्थन करता है उसे जोड़ देता है। पिन के अपने सोर्स की अहमियत फिर भी सबसे ज़्यादा रहती है। AI तस्वीरें भी देखता है: जो तस्वीर कुछ और दिखाती हो या ठीक से न दिखाती हो, उसे नीचे कर दिया जाता है या बदल दिया जाता है।