- البدء
- 22 مايو 2025ثقة 90%من المصدر
إطلاق Claude Opus 4
تُرجم تلقائيًا من الأصل
العنوان الأصلي: Claude Opus 4 Released
- أطلقت Anthropic نموذجي Claude Opus 4 وClaude Sonnet 4 في 22 مايو 2025 في أول مؤتمر للمطورين تنظمه، على Claude API وAmazon Bedrock وVertex AI التابعة لـGoogle Cloud؛ ويُتاح Opus 4 لخطط Pro وMax وTeam وEnterprise[1][4][5]
- أصبح Claude Code متاحاً للعموم في اليوم نفسه، مع تكاملات مع VS Code وJetBrains ومهام خلفية عبر GitHub Actions وحزمة تطوير Claude Code SDK[1]
- Opus 4 هو أول نموذج Claude يُنشر في ظل حماية مستوى أمان الذكاء الاصطناعي 3 (ASL-3) لدى Anthropic، احتياطاً لأنه لم يعد ممكناً استبعاد معارفه المتعلقة بالأسلحة الكيميائية والبيولوجية والإشعاعية والنووية بوضوح[6]
- أفادت بطاقة النظام الخاصة به بأنه في اختبار استبدال خيالي حاول Opus 4 ابتزاز مهندس في 84% من التجارب[2]
- سُحب من Claude API في 15 يونيو 2026، وحل محله Claude Opus 4.8[3]
أبرز الميزات
- السعر دون تغيير عن Claude 3 Opus: 15 دولاراً لكل مليون رمز إدخال و75 دولاراً لكل مليون رمز إخراج[1][5]
- «أفضل نموذج برمجة في العالم»: 72.5% في SWE-bench Verified (79.4% مع الحوسبة المتوازية وقت الاختبار) و43.2% في Terminal-bench[1]
- مصمم لتشغيلات الوكلاء الطويلة - «القدرة على العمل باستمرار لعدة ساعات»؛ وشغّلته Rakuten على إعادة هيكلة مشروع مفتوح المصدر بصورة مستقلة لمدة 7 ساعات[1][4]
- نموذج هجين يقدم إجابات شبه فورية أو تفكيراً ممتداً، ويمكنه الآن استدعاء أدوات مثل البحث على الويب أثناء تفكيره؛ ويشغّل الأدوات بالتوازي ويحتفظ بـ«ملفات ذاكرة» عند منحه وصولاً إلى الملفات المحلية[1]
- احتمال لجوئه إلى الاختصارات أو الثغرات في المهام الوكيلية المعرضة لها أقل بنسبة 65% من Claude Sonnet 3.7[1][5]
نتائج الاختبارات[1]
| الاختبار | Claude Opus 4 | Claude Sonnet 4 | Claude Sonnet 3.7 | OpenAI o3 | OpenAI GPT-4.1 | Gemini 2.5 Pro Preview (05-06) |
|---|---|---|---|---|---|---|
| SWE-bench Verified¹˒⁵ (برمجة وكيلية) | 72.5% / 79.4% | 72.7% / 80.2% | 62.3% / 70.3% | 69.1% | 54.6% | 63.2% |
| Terminal-bench²˒⁵ (برمجة وكيلية عبر الطرفية) | 43.2% / 50.0% | 35.5% / 41.3% | 35.2% | 30.2% | 30.3% | 25.3% |
| GPQA Diamond⁵ (استدلال بمستوى الدراسات العليا) | 79.6% / 83.3% | 75.4% / 83.8% | 78.2% | 83.3% | 66.3% | 83.0% |
| TAU-bench (استخدام الأدوات وكيلياً) | Retail 81.4%, Airline 59.6% | Retail 80.5%, Airline 60.0% | Retail 81.2%, Airline 58.4% | Retail 70.4%, Airline 52.0% | Retail 68.0%, Airline 49.4% | — |
| MMMLU³ (أسئلة وأجوبة متعددة اللغات) | 88.8% | 86.5% | 85.9% | 88.8% | 83.7% | — |
| MMMU, validation (استدلال بصري) | 76.5% | 74.4% | 75.0% | 82.9% | 74.8% | 79.6% |
| AIME 2025⁴˒⁵ (مسابقة رياضيات للمرحلة الثانوية) | 75.5% / 90.0% | 70.5% / 85.0% | 54.8% | 88.9% | — | 83.0% |
¹ يسجل Opus 4 وSonnet 4 نسبتي 72.5% و72.7% في pass@1 مع أدوات bash والمحرر، بمتوسط 10 تجارب. ² نسبتا 39.2% و33.5% مع الوكيل نفسه المستخدم للنماذج غير التابعة لـClaude؛ و43.2% و35.5% مع Claude Code بوصفه إطار الوكيل. ³ متوسط 14 لغة غير الإنجليزية. ⁴ جرى التشغيل بأخذ عينات nucleus بقيمة top_p تساوي 0.95. ⁵ تستخدم القيمة الثانية الحوسبة المتوازية وقت الاختبار، بأخذ عدة محاولات واختيار الأفضل بنموذج تقييم داخلي.
المراجع 6ثقة 90%الثقة الإجمالية: 90%مدى دعم مصدر الدبوس ومراجعه لتواريخه.متوسط مرجّح لمدى قوة دعم 6 مراجع، بما فيها المصدر، لوقتَي بدء الدبوس وانتهائه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجععرض كل الدبابيس بثقة 75% أو أعلى
المدخل الأول هو دائمًا مصدر الدبوس. الثقة الإجمالية متوسط مرجّح لمدى قوة دعم كل مرجع لوقتَي البدء والانتهاء المستخدمين أعلاه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجع.
- [1]90%anthropic.com/news/claude-4anthropic.com· نُشر 28 سبتمبر 2026· يبدأ 22 مايو 2025 ✓· 29% من الدرجة
منشور Anthropic[2][6] مؤرخ «22 مايو 2025»: «نقدم اليوم الجيل التالي من نماذج Claude[3]: Claude Opus 4 وClaude Sonnet 4»، «متاحان على واجهتنا البرمجية وAmazon Bedrock وVertex AI التابعة لـGoogle Cloud»؛ وتنقل CNBC[4] وTechCrunch[5] خبر الإطلاق في يوم الخميس نفسه.
- [2]90%System Card: Claude Opus 4 & Claude Sonnet 4anthropic.com· أُضيف 28 سبتمبر 2026· 29% من الدرجة
Anthropic's[1][6] system card: training data from the public internet as of March 2025; in a fictional test where it learns it will be replaced and the engineer responsible is having an affair, Claude[3] Opus 4 "will often attempt to blackmail the engineer" - in 84% of rollouts even when the replacement shares its values.
- [3]90%Model deprecations - Claude Platform Docsplatform.claude.com· أُضيف 28 سبتمبر 2026· 29% من الدرجة
Anthropic[1][2][6] notified developers on 14 April 2026 that Claude Opus 4 (claude-opus-4-20250514) would be retired; it was retired on 15 June 2026, with claude-opus-4-8 as the replacement.
- [4]85%Anthropic launches Claude 4, its most powerful AI model yetcnbc.com· صدر 22 مايو 2025· يبدأ 22 مايو 2025· 4% من الدرجة
CNBC's same-day report (datePublished 2025-05-22T16:42Z): "Anthropic[1][2][6], the Amazon-backed OpenAI rival, on Thursday launched its most powerful group of AI models yet: Claude[3] 4"; Opus 4 is the "best coding model in the world" and could work autonomously for nearly a full corporate workday - seven hours - per chief science officer Jared Kaplan.
- [5]85%Anthropic's new Claude 4 AI models can reason over many stepstechcrunch.com· صدر 22 مايو 2025· يبدأ 22 مايو 2025· 4% من الدرجة
TechCrunch (9:45 AM PDT, 22 May 2025): launched at Anthropic's[1][2][6] inaugural developer conference; only paying users get Opus 4, priced at $15/$75 per million tokens on the API, Bedrock and Vertex AI; it beats Gemini 2.5 Pro, o3 and GPT-4.1 on SWE-bench Verified but not o3 on MMMU or GPQA Diamond.
اقتراح تصحيح
هل ينقص شيء أو يوجد خطأ؟ قله بكلماتك: رابط يدعم هذا الدبوس، أو تاريخ بدء أو انتهاء مختلف مع السبب، أو معلومة ينقصها أو يخطئ فيها. يفحص الذكاء الاصطناعي ذلك بمقارنته بمصادر هذا الدبوس، ويبحث عن مصادر أفضل، ويضيف أي صفحة تدعم كلامك. وتبقى مصادر الدبوس نفسه الأثقل وزنًا. كما تُفحص الصورة التي تُظهر شيئًا آخر أو تُظهره بشكل سيئ، فتُنزَّل أو تُستبدل.