- البدء
- 29 سبتمبر 2025ثقة 90%من المصدر
إطلاق Claude Sonnet 4.5
تُرجم تلقائيًا من الأصل
العنوان الأصلي: Claude Sonnet 4.5 Released
- وصفته Anthropic بأنه «أفضل نموذج برمجة في العالم. وهو الأقوى لبناء الوكلاء المعقدين. وهو الأفضل في استخدام الحواسيب»[1][4]
- «متاح في كل مكان اليوم» باسم claude-sonnet-4-5 على الواجهة البرمجية لـ Claude وفي تطبيقاته؛ وقال مايك كريغر إنه سيكون النموذج الافتراضي وأوصى به لـ«كل حالات الاستخدام تقريباً»[1][5]
- صدر مع نقاط استعادة في Claude Code وامتداد أصلي لـ VS Code، وميزة تحرير السياق وأداة الذاكرة في الواجهة البرمجية، وتنفيذ الشيفرة وإنشاء الملفات في تطبيقات Claude، وحزمة Claude Agent SDK، وهي البنية التحتية وراء Claude Code[1][4]
- «هذا أكثر النماذج المتقدمة توافقاً مع القيم التي أصدرناها على الإطلاق»، مع معدلات أقل من التملق والخداع، وقد صدر بحماية مستوى سلامة الذكاء الاصطناعي الثالث (ASL-3)[1][3][4]
- وصل بعد أقل من شهرين على Claude Opus 4.1، فيما تبلغ قيمة Anthropic 183 مليار دولار[4][5]
أبرز الميزات
- $3 لكل مليون رمز إدخال و$15 لكل مليون رمز إخراج كما في Sonnet 4؛ ونافذة سياق من 200 ألف رمز وحد أقصى للإخراج 64 ألفاً وموعد معرفة موثوقة ينتهي في يناير 2025[1][2]
- 77.2% في SWE-bench Verified بمتوسط 10 محاولات ودون حوسبة إضافية وقت الاختبار، و82.0% مع حوسبة متوازية وقت الاختبار[1]
- يتصدر OSWorld لاستخدام الحاسوب بنسبة 61.4%، بعدما تصدره Sonnet 4 بنسبة 42.2% قبل أربعة أشهر[1]
- رصدت Anthropic احتفاظه بالتركيز أكثر من 30 ساعة في المهام المعقدة متعددة الخطوات؛ وتشير CNBC إلى أن Opus 4 استطاع سبع ساعات[1][5]
- وجد خبراء في المالية والقانون والطب والعلوم والهندسة أن معرفته واستدلاله في مجالاتهم متقدمان كثيراً على النماذج الأقدم، ومنها Opus 4.1[1]
نتائج الاختبارات[1]
| الاختبار | Claude Sonnet 4.5 | Claude Opus 4.1 | Claude Sonnet 4 | GPT-5 | Gemini 2.5 Pro |
|---|---|---|---|---|---|
| البرمجة الوكيلية (SWE-bench Verified) | 77.2% / 82.0% مع حوسبة متوازية وقت الاختبار | 74.5% / 79.4% مع حوسبة متوازية وقت الاختبار | 72.7% / 80.2% مع حوسبة متوازية وقت الاختبار | 72.8% (GPT-5) / 74.5% (GPT-5-Codex) | 67.2% |
| البرمجة الوكيلية عبر الطرفية (Terminal-Bench) | 50.0% | 46.5% | 36.4% | 43.8% | 25.3% |
| استخدام الأدوات الوكيلي (τ2-bench)، التجزئة | 86.2% | 86.8% | 83.8% | 81.1% | — |
| استخدام الأدوات الوكيلي (τ2-bench)، الطيران | 70.0% | 63.0% | 63.0% | 62.6% | — |
| استخدام الأدوات الوكيلي (τ2-bench)، الاتصالات | 98.0% | 71.5% | 49.6% | 96.7% | — |
| استخدام الحاسوب (OSWorld) | 61.4% | 44.4% | 42.2% | — | — |
| مسابقة رياضيات للمرحلة الثانوية (AIME 2025) | 100% (python) / 87.0% (بدون أدوات) | 78.0% | 70.5% | 99.6% (python) / 94.6% (بدون أدوات) | 88.0% |
| الاستدلال على مستوى الدراسات العليا (GPQA Diamond) | 83.4% | 81.0% | 76.1% | 85.7% | 86.4% |
| أسئلة وأجوبة متعددة اللغات (MMMLU) | 89.1% | 89.5% | 86.5% | 89.4% | — |
| الاستدلال البصري (MMMU، مجموعة التحقق) | 77.8% | 77.1% | 74.4% | 84.2% | 82.0% |
| التحليل المالي (Finance Agent) | 55.3% | 50.9% | 44.5% | 46.9% | 29.4% |
المراجع 5ثقة 89%الثقة الإجمالية: 89%مدى دعم مصدر الدبوس ومراجعه لتواريخه.متوسط مرجّح لمدى قوة دعم 5 مراجع، بما فيها المصدر، لوقتَي بدء الدبوس وانتهائه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجععرض كل الدبابيس بثقة 75% أو أعلى
المدخل الأول هو دائمًا مصدر الدبوس. الثقة الإجمالية متوسط مرجّح لمدى قوة دعم كل مرجع لوقتَي البدء والانتهاء المستخدمين أعلاه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجع.
- [1]90%anthropic.com/news/claude-sonnet-4-5anthropic.com· نُشر 28 سبتمبر 2026· يبدأ 29 سبتمبر 2025 ✓· 29% من الدرجة
المنشور مؤرخ «29 سبتمبر 2025» ويقول: «Claude[2] Sonnet 4.5 متاح في كل مكان اليوم»؛ وتذكر صفحة النموذج في الوثائق «صدر في 29 سبتمبر 2025» وتفيد TechCrunch[4] بأن الإطلاق جرى «يوم الاثنين».
- [2]90%Claude Sonnet 4.5 - Claude Platform Docsplatform.claude.com· أُضيف 28 سبتمبر 2026· 29% من الدرجة
Anthropic's[1][3] model page: claude-sonnet-4-5-20250929, 200K context window, 64K max output, $3/$15 per million tokens, extended thinking, text and images in, a January 2025 reliable knowledge cutoff, "Released September 29, 2025".
- [3]90%System Card: Claude Sonnet 4.5anthropic.com· أُضيف 28 سبتمبر 2026· 29% من الدرجة
Anthropic's[1] system card for Claude[2] Sonnet 4.5, "a new hybrid reasoning large language model" (September 2025), with the alignment and safety evaluations behind its ASL-3 release.
- [4]85%Anthropic launches Claude Sonnet 4.5, its best AI model for codingtechcrunch.com· صدر 29 سبتمبر 2025· يبدأ 29 سبتمبر 2025· 7% من الدرجة
TechCrunch, 2025-09-29: "On Monday, Anthropic[1][3] launched a new frontier model called Claude[2] Sonnet 4.5" at Sonnet 4's $3/$15; researcher David Hershey saw it code autonomously for up to 30 hours; it arrives less than two months after Claude Opus 4.1.
- [5]85%Anthropic launches Claude Sonnet 4.5, its latest AI model that's 'more of a colleague'cnbc.com· صدر 29 سبتمبر 2025· يبدأ 29 سبتمبر 2025· 7% من الدرجة
CNBC, 2025-09-29: available to all users from the $183 billion startup; Mike Krieger says it will be the default and recommends it for "basically every use case"; it runs autonomously for 30 hours against Opus 4's seven.
اقتراح تصحيح
هل ينقص شيء أو يوجد خطأ؟ قله بكلماتك: رابط يدعم هذا الدبوس، أو تاريخ بدء أو انتهاء مختلف مع السبب، أو معلومة ينقصها أو يخطئ فيها. يفحص الذكاء الاصطناعي ذلك بمقارنته بمصادر هذا الدبوس، ويبحث عن مصادر أفضل، ويضيف أي صفحة تدعم كلامك. وتبقى مصادر الدبوس نفسه الأثقل وزنًا. كما تُفحص الصورة التي تُظهر شيئًا آخر أو تُظهره بشكل سيئ، فتُنزَّل أو تُستبدل.