- البدء
- 19 مايو 2026ثقة 95%من deepmind.google
إطلاق Gemini 3.5 Flash
تُرجم تلقائيًا من الأصل
العنوان الأصلي: Gemini 3.5 Flash Released
- أطلقت غوغل Gemini 3.5 Flash في 19 May 2026 خلال مؤتمر Google I/O، وتقول إنه أقوى نماذجها حتى الآن في البرمجة والوكلاء المستقلين[1]
- قال كوراي كافوكجوغلو إنه «يتفوق على أحدث نماذجنا الرائدة، 3.1 Pro، في معظم الاختبارات تقريبًا»، وإنه أسرع بأربع مرات من النماذج الرائدة الأخرى، مع نسخة محسّنة أسرع 12 مرة بالجودة نفسها[1]
- طُوّر بالتعاون مع Google Antigravity، وفي عرض تجريبي أنشأ وكلاء نظام تشغيل كاملًا من الصفر؛ وأصدرت غوغل في اليوم نفسه Antigravity 2.0، وهو تطبيق مستقل لسطح المكتب[1]
- وقالت غوغل إن 3.5 Pro القادم سيعمل «منسّقًا» مع Flash وكلاء فرعيين، وإن 3.5 يتضمن ضمانات أقوى ضد المخاطر السيبرانية والكيميائية والبيولوجية والإشعاعية والنووية[1]
أبرز الميزات
- 76.2% في Terminal-bench 2.1 (مقابل 58.0% لـ3 Flash)، و55.1% في SWE-Bench Pro، و78.4% في OSWorld-Verified لاستخدام الحاسوب[3]
- 83.6% في MCP Atlas، و1656 Elo في GDPval-AA لأعمال المعرفة، و84.2% في CharXiv Reasoning، و72.1% في ARC-AGI-2[3]
- يمكنه العمل باستقلالية لعدة ساعات، متوقفًا لطلب المدخلات عند نقاط القرار[1]
اختبارات الأداء[3]
| الاختبار | Gemini 3.5 Flash | Gemini 3 Flash | Gemini 3.1 Pro | Claude Sonnet 4.6 | Claude Opus 4.7 | GPT-5.5 |
|---|---|---|---|---|---|---|
| Terminal-bench 2.1 (البرمجة الوكيلة عبر الطرفية، أداة Terminus-2) | 76.2% | 58.0% | 70.3% | — | 66.1% | 78.2% |
| SWE-Bench Pro (Public) (مهام برمجة وكيلة متنوعة، محاولة واحدة) | 55.1% | 49.6% | 54.2% | — | 64.3% | 58.6% |
| MCP Atlas (سير عمل متعدد الخطوات باستخدام MCP) | 83.6% | 62.0% | 78.2% | 69.5% | 79.1% | 75.3% |
| Toolathlon (استخدام الأدوات العام في العالم الواقعي) | 56.5% | 49.4% | — | — | — | 55.6% |
| OSWorld-Verified (استخدام الحاسوب الوكيل) | 78.4% | 65.1% | 76.2% | 72.5% | 78.0% | 78.7% |
| Finance Agent v2 (التحليل المالي واتخاذ القرار) | 57.9% | 42.6% | 43.0% | 51.0% | 51.5% | 51.8% |
| GDPval-AA (أعمال المعرفة ذات القيمة الاقتصادية، Elo) | 1656 | 1204 | 1314 | 1676 | 1753 | 1769 |
| CharXiv Reasoning (تجميع المعلومات من الرسوم البيانية المعقدة، دون أدوات) | 84.2% | 80.3% | 83.3% | 72.4% | 82.1% | 84.1% |
| MMMU-Pro (الفهم والاستدلال متعدد الوسائط، دون أدوات) | 83.6% | 81.2% | 80.5% | 74.5% | 75.2% | 81.2% |
| Blueprint-Bench 2 (الاستدلال المكاني الوكيل، درجة معيارية) | 33.6% | 0.0% | 26.5% | 6.7% | 24.5% | 36.2% |
| MRCR v2 (8-needle) (أداء السياق الطويل، 128k (المتوسط)) | 77.3% | 67.2% | 84.9% | 84.9% | 59.3% | 94.8% |
| MRCR v2 (8-needle) (أداء السياق الطويل، 1M (نقطي)) | 26.6% | 22.1% | 26.3% | — | — | — |
| Humanity’s Last Exam (الاستدلال الأكاديمي، المجموعة الكاملة نص + وسائط) | 40.2% | 33.7% | 44.4% | 33.2% | 46.9% | 41.4% |
| ARC-AGI-2 (ألغاز الاستدلال المجرد) | 72.1% | 33.6% | 77.1% | 58.3% | 75.8% | 84.6% |
المراجع 3ثقة 85%الثقة الإجمالية: 85%مدى دعم مصدر الدبوس ومراجعه لتواريخه.متوسط مرجّح لمدى قوة دعم 3 مراجع، بما فيها المصدر، لوقتَي بدء الدبوس وانتهائه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجععرض كل الدبابيس بثقة 75% أو أعلى
المدخل الأول هو دائمًا مصدر الدبوس. الثقة الإجمالية متوسط مرجّح لمدى قوة دعم كل مرجع لوقتَي البدء والانتهاء المستخدمين أعلاه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجع.
- [1]90%techcrunch.com/2026/05/19/with-gemini-3-5-flash-google-bets-its-next-ai-wave-on-agents-not-chatbotstechcrunch.com· نُشر 30 سبتمبر 2026· يبدأ 19 مايو 2026· 39% من الدرجة
ذكر موقع TechCrunch أن غوغل أطلقت Gemini 3.5 Flash يوم الثلاثاء 19 May 2026 في مؤتمرها السنوي للمطورين I/O؛ ونُشرت بطاقة نموذج Google DeepMind[3] الخاصة بـ3.5 Flash في اليوم نفسه.
- [2]75%Gemini (language model) - Wikipediaen.wikipedia.org· أُضيف 30 سبتمبر 2026· 39% من الدرجة
The Wikipedia article lists Gemini 3.5 Flash as released on 19 May 2026, based on Gemini 3 Flash.
- [3]95%Gemini 3.5 Flash - Model Carddeepmind.google· صدر 19 مايو 2026· يبدأ 19 مايو 2026 ✓· 23% من الدرجة
DeepMind's model card, published 19 May 2026, gives the benchmark results against Gemini 3 Flash, 3.1 Pro, Claude Sonnet 4.6, Claude Opus 4.7 and GPT-5.5.
اقتراح تصحيح
هل ينقص شيء أو يوجد خطأ؟ قله بكلماتك: رابط يدعم هذا الدبوس، أو تاريخ بدء أو انتهاء مختلف مع السبب، أو معلومة ينقصها أو يخطئ فيها. يفحص الذكاء الاصطناعي ذلك بمقارنته بمصادر هذا الدبوس، ويبحث عن مصادر أفضل، ويضيف أي صفحة تدعم كلامك. وتبقى مصادر الدبوس نفسه الأثقل وزنًا. كما تُفحص الصورة التي تُظهر شيئًا آخر أو تُظهره بشكل سيئ، فتُنزَّل أو تُستبدل.