- البدء
- 30 سبتمبر 2026ثقة 90%من المصدر
الإعلان عن Gemini 4 Argon
تُرجم تلقائيًا من الأصل
العنوان الأصلي: Gemini 4 Argon Announced
- أعلنت غوغل عن Gemini 4 Argon في 30 September 2026، واصفةً إياه بأنه «نموذجها الرائد الجديد» لهندسة البرمجيات الواقعية وأعمال المعرفة في الشركات مثل القانون والمالية، والدفاع السيبراني[1]
- يُطرح أولًا لمجموعة من المدافعين السيبرانيين الموثوقين عبر برنامج Fairwind، وتشارك غوغل في العملية الطوعية للحكومة الأمريكية للوصول المسبق إلى النماذج قبل إصدارها بينما توسّع الوصول تدريجيًا[1]
- ستتيحه غوغل للمطورين والشركات والمستهلكين «في أقرب وقت ممكن»، بدءًا من عملاء واجهة البرمجة المدفوعين ومشتركي Google AI Ultra، لذا لا يزال الإصدار الواسع معلقًا[1]
- داخليًا يشغّل بالفعل سير عمل غوغل: حرر وكلاء أكثر من 300 TiB من الذاكرة عبر مراكز البيانات، وتفوقوا بنسبة 40% على خط أساس لروتين كمّي فرعي، وساعدوا في ترحيل ما يصل إلى 800K+ سطر من C/C++ إلى Rust في نواة Zircon لنظام Fuchsia[1]
- وفي عرض توضيحي للدفاع السيبراني اكتشف ثغرة حرجة في برمجيات رعاية صحية تستخدمها المستشفيات حول العالم فاتت النماذج الرائدة السابقة[1]
أبرز الميزات
- توسيع حد الإخراج إلى مليون رمز بعد أن كان 64K، بحيث يستطيع النموذج الاستدلال عبر مئات الآلاف من الرموز في مسار واحد[1]
- سعر تمهيدي $2 لكل مليون رمز إدخال و$10 لكل مليون رمز إخراج، مع إدخال مخزّن مؤقتًا أرخص بنسبة 95%؛ وبعد ذلك $4 و$20 لكل مليون[1]
- مستوى جديد هو الأحدث في DeepSWE v1.1 بنسبة 77.9% (GPT-6 Astra: 74.1%، Claude Opus 5.5: 74.2%)، والمركز الأول في AutomationBench بنسبة 51.3% وفي Vals Index بنسبة 68.9%[1][2]
- 91.7% في LVBench لفهم الفيديو الطويل، و65.4% في Vals Finance Agent v2، و19.6% في Harvey's Legal Agent Benchmark[1][2]
- 68.0% في CWE-bench v1 لإصلاح الثغرات، بالتساوي في المركز الأول؛ وتطلقه غوغل دون ضوابط الحماية السيبرانية للمدافعين الموثوقين ولفرقها الخاصة[1][2]
- الضمانات: رفض الطلبات الضارة مع الحفاظ على العلوم المزدوجة الاستخدام المشروعة، وأعلى درجة في اختبار Gray Swan لحقن المطالبات غير المباشر، ومراقبة سلسلة التفكير والإجراءات بما يوقف التنفيذ الخارج عن الحدود، وبيئات معزولة مشددة[1][2]
اختبارات الأداء[2]
| الاختبار | Gemini 4 Argon | GPT-6 Astra | Claude Fable 5.1 | Claude Opus 5.5 |
|---|---|---|---|---|
| Vals Index (أعمال المعرفة) | 68.9% | 63.1% | 65.8% | 67.0% |
| AutomationBench (أعمال المعرفة، الدرجة) | 51.3% | 41.4% | 31.4% | 42.5% |
| Vals Finance Agent v2 (أعمال المعرفة) | 65.4% | 53.5% | 58.9% | 58.6% |
| Harvey's Legal Agent Benchmark (أعمال المعرفة) | 19.6% | 5.4% | 6.7% | 3.8% |
| DeepSWE v1.1 (البرمجة الوكيلة) | 77.9% | 74.1% | 67.4% | 74.2% |
| FrontierSWE v2 (البرمجة الوكيلة) | 55.0% | 65.5% | 56.3% | 62.3% |
| Vibe Code Bench (البرمجة الوكيلة) | 91.9% | 89.6% | 90.3% | 90.3% |
| Terminal-bench 4.0 (البرمجة الوكيلة) | 57.4% | 58.2% | 57.9% | 66.4% |
| PostTrainBench (هندسة تعلم الآلة) | 45.3% | 44.3% | 40.2% | 49.3% |
| Terminal-Bench Science 0.1 (العلوم والرياضيات) | 57.6% | 68.1% | 52.6% | 63.3% |
| LABBench 2 (العلوم والرياضيات) | 88.8% | 85.4% | 68.6% | 73.1% |
| RiemannBench (العلوم والرياضيات) | 76.0% | 72.0% | 65.6% | 69.6% |
| GraphWalks (السياق الطويل، حتى 128k، BFS (F1)) | 99.7% | 98.7% | 91.4% | 90.6% |
| GraphWalks (السياق الطويل، من 256k إلى 1M، BFS (F1)) | 84.2% | 71.8% | 65.0% | 66.8% |
| Agent's Last Exam (استخدام الحاسوب، معدل النجاح) | 39.5% | 34.2% | — | 38.2% |
| OSWorld-2.0 (استخدام الحاسوب، مجموعة فرعية دون اتصال، درجة جزئية) | 69.2% | 72.6% | — | — |
| Chartography (الفهم متعدد الوسائط) | 71.6% | 71.0% | 46.2% | 66.3% |
| LVBench (الفهم متعدد الوسائط) | 91.7% | 87.5% | 79.7% | 83.7% |
| CWE-bench v1 (الأمن السيبراني) | 68.0% | 68.0% | 58.0% | 67.0% |
المراجع 2ثقة 87%الثقة الإجمالية: 87%مدى دعم مصدر الدبوس ومراجعه لتواريخه.متوسط مرجّح لمدى قوة دعم مرجعين، بما فيهما المصدر، لوقتَي بدء الدبوس وانتهائه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجععرض كل الدبابيس بثقة 75% أو أعلى
المدخل الأول هو دائمًا مصدر الدبوس. الثقة الإجمالية متوسط مرجّح لمدى قوة دعم كل مرجع لوقتَي البدء والانتهاء المستخدمين أعلاه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجع.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-4-argonblog.google· نُشر 30 سبتمبر 2026· يبدأ 30 سبتمبر 2026 ✓· 50% من الدرجة
منشور غوغل «Gemini 4 Argon: عصرنا القادم من الذكاء الرائد» مؤرخ في 30 September 2026 ويقول: «اليوم نعلن عن نموذجنا الرائد الجديد Gemini 4 Argon الذي يُطرح لمجموعة من المدافعين السيبرانيين الموثوقين»؛ ويأتي الإتاحة الواسعة للمطورين والشركات والمستهلكين «في أقرب وقت ممكن» (انظر التثبيت التقديري 4810).
- [2]85%Gemini - Google DeepMinddeepmind.google· أُضيف 30 سبتمبر 2026· يبدأ 30 سبتمبر 2026· 50% من الدرجة
DeepMind's Gemini page now leads with Gemini 4 Argon and carries its benchmark table against GPT-6 Astra, Claude Fable 5.1 and Claude Opus 5.5, plus the four safeguard areas Google is strengthening before broad availability.
اقتراح تصحيح
هل ينقص شيء أو يوجد خطأ؟ قله بكلماتك: رابط يدعم هذا الدبوس، أو تاريخ بدء أو انتهاء مختلف مع السبب، أو معلومة ينقصها أو يخطئ فيها. يفحص الذكاء الاصطناعي ذلك بمقارنته بمصادر هذا الدبوس، ويبحث عن مصادر أفضل، ويضيف أي صفحة تدعم كلامك. وتبقى مصادر الدبوس نفسه الأثقل وزنًا. كما تُفحص الصورة التي تُظهر شيئًا آخر أو تُظهره بشكل سيئ، فتُنزَّل أو تُستبدل.