- البدء
- 17 فبراير 2026ثقة 90%من المصدر
إطلاق Claude Sonnet 4.6
تُرجم تلقائيًا من الأصل
العنوان الأصلي: Claude Sonnet 4.6 Released
- «Claude Sonnet 4.6 هو أقوى نماذج Sonnet لدينا حتى الآن»، وهو ترقية شاملة في البرمجة واستخدام الحاسوب والاستدلال على السياقات الطويلة وتخطيط الوكلاء والعمل المعرفي والتصميم[1][4]
- أصبح النموذج الافتراضي في claude.ai وClaude Cowork لمستخدمي Free وPro، وحصلت الخطة المجانية على إنشاء الملفات والموصلات والمهارات والضغط؛ وهو متاح في كل خطط Claude وClaude Code والواجهة البرمجية وجميع المنصات السحابية الكبرى[1][3][4]
- في Claude Code فضّله المختبرون الأوائل على Sonnet 4.5 بنحو 70% من الحالات، وحتى على Opus 4.5، النموذج الرائد لدى Anthropic في نوفمبر، بنسبة 59%، واصفين إياه بأنه أقل ميلاً إلى الإفراط في الهندسة و«الكسل»[1]
- وجد باحثو السلامة «شخصية دافئة وصادقة ومراعية للمجتمع، ومرحة في بعض الأحيان» ولا مؤشرات على اختلال كبير في المواءمة عالي المخاطر؛ وهو يقاوم حقن المطالبات أفضل بكثير من Sonnet 4.5 وصدر بموجب ASL-3[1][5]
- ربطت CNBC الإطلاق بموجة بيع في أسهم البرمجيات، إذ تراجع صندوق IGV للبرمجيات أكثر من 20% منذ بداية العام[3]
أبرز الميزات
- السعر دون تغيير عن Sonnet 4.5، أي $3 لكل مليون رمز إدخال و$15 لكل مليون رمز إخراج؛ ونافذة سياق من مليون رمز (بيتا عند الإطلاق) وحد أقصى للإخراج 128 ألفاً[1][2]
- بحسب جدول Anthropic: 79.6% في SWE-bench Verified و72.5% في OSWorld-Verified (Sonnet 4.5: 61.4%) و59.1% في Terminal-Bench 2.0 و74.7% في BrowseComp[1]
- يرسم مخطط OSWorld لديها مسار عائلة Sonnet من 14.9% لـ Claude 3.5 Sonnet الصادر في أكتوبر 2024 إلى 72.5% لـ Sonnet 4.6[1]
- تفكير تكيفي وممتد، إضافة إلى ضغط السياق في بيتا الذي يلخص السياق الأقدم كلما اقتربت المحادثة من حدها[1][2]
- يضاهي Opus 4.6 في OfficeQA، اختبار Databricks لقراءة المخططات وملفات PDF والجداول المؤسسية، وفي Vending-Bench Arena استثمر بكثافة عشرة أشهر افتراضية قبل أن يتحول إلى تحقيق الربح[1]
نتائج الاختبارات[1]
| الاختبار | Sonnet 4.6 | Sonnet 4.5 | Opus 4.6 | Opus 4.5 | Gemini 3 Pro | GPT-5.2 (جميع النماذج) |
|---|---|---|---|---|---|---|
| البرمجة الوكيلية عبر الطرفية (Terminal-Bench 2.0) | 59.1% | 51.0% | 65.4% | 59.8% | 56.2% (54.2% بحسب الشركة) | 64.7% (64.0% بحسب الشركة، Codex CLI) |
| البرمجة الوكيلية (SWE-bench Verified) | 79.6% | 77.2% | 80.8% | 80.9% | 78.0% (Flash) | 80.0% |
| استخدام الحاسوب الوكيلي (OSWorld-Verified) | 72.5% | 61.4% | 72.7% | 66.3% | — | 38.2% |
| استخدام الأدوات الوكيلي (τ2-bench)، التجزئة | 91.7% | 86.2% | 91.9% | 88.9% | 85.3% | 82.0% |
| استخدام الأدوات الوكيلي (τ2-bench)، الاتصالات | 97.9% | 98.0% | 99.3% | 98.2% | 98.0% | 98.7% |
| استخدام الأدوات على نطاق واسع (MCP-Atlas) | 61.3% | 43.8% | 59.5% | 62.3% | 54.1% | 60.6% |
| البحث الوكيلي (BrowseComp) | 74.7% | 43.9% | 84.0% | 67.8% | 59.2% (Deep Research) | 77.9% (Pro) |
| الاستدلال متعدد التخصصات (Humanity's Last Exam)، بدون أدوات | 33.2% | 17.7% | 40.0% | 30.8% | 37.5% | 36.6% (Pro) |
| الاستدلال متعدد التخصصات (Humanity's Last Exam)، مع أدوات | 49.0% | 33.6% | 53.0% | 43.4% | 45.8% | 50.0% (Pro) |
| التحليل المالي الوكيلي (Finance Agent v1.1) | 63.3% | 54.5% | 60.1% | 58.8% | 55.2% | 59.0% |
| مهام المكتب (GDPval-AA Elo) | 1633 | 1276 | 1606 | 1416 | 1201 | 1462 |
| حل المسائل الجديدة (ARC-AGI-2) | 58.3% | 13.6% | 68.8% | 37.6% | 31.1% | 54.2% (Pro) |
| الاستدلال على مستوى الدراسات العليا (GPQA Diamond) | 89.9% | 83.4% | 91.3% | 87.0% | 91.9% | 93.2% (Pro) |
| الاستدلال البصري (MMMU-Pro)، بدون أدوات | 74.5% | 63.4% | 73.9% | 70.6% | 81.0% | 79.5% |
| الاستدلال البصري (MMMU-Pro)، مع أدوات | 75.6% | 68.9% | 77.3% | 73.9% | — | 80.4% |
| أسئلة وأجوبة متعددة اللغات (MMMLU) | 89.3% | 89.5% | 91.1% | 90.8% | 91.8% | 89.6% |
المراجع 5ثقة 88%الثقة الإجمالية: 88%مدى دعم مصدر الدبوس ومراجعه لتواريخه.متوسط مرجّح لمدى قوة دعم 5 مراجع، بما فيها المصدر، لوقتَي بدء الدبوس وانتهائه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجععرض كل الدبابيس بثقة 75% أو أعلى
المدخل الأول هو دائمًا مصدر الدبوس. الثقة الإجمالية متوسط مرجّح لمدى قوة دعم كل مرجع لوقتَي البدء والانتهاء المستخدمين أعلاه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجع.
- [1]90%anthropic.com/news/claude-sonnet-4-6anthropic.com· نُشر 28 سبتمبر 2026· يبدأ 17 فبراير 2026 ✓· 31% من الدرجة
المنشور مؤرخ «17 فبراير 2026» ويقول: «Claude[2] Sonnet 4.6 متاح الآن في جميع خطط Claude وClaude Cowork وClaude Code وواجهتنا البرمجية وجميع المنصات السحابية الكبرى»؛ وتذكر صفحة النموذج في الوثائق «صدر في 17 فبراير 2026» وأوردت CNBC[3] الخبر في اليوم نفسه.
- [2]90%Claude Sonnet 4.6 - Claude Platform Docsplatform.claude.com· أُضيف 28 سبتمبر 2026· 31% من الدرجة
Anthropic's[1][5] model page: claude-sonnet-4-6, 1M-token context, 128K max output (300K Batch beta), $3/$15 per million tokens, adaptive thinking (extended deprecated), text and images in, an August 2025 reliable knowledge cutoff, "Released February 17, 2026".
- [3]85%Anthropic releases Claude Sonnet 4.6, continuing breakneck pace of AI model releasescnbc.com· صدر 17 فبراير 2026· يبدأ 17 فبراير 2026· 13% من الدرجة
CNBC, 2026-02-17: the default for free and Pro users in Claude[2] and Claude Cowork, better at computers, coding, design and knowledge work; Anthropic's[1][5] advances had fed a sell-off in software stocks, with the iShares Expanded Tech-Software Sector ETF (IGV) down more than 20% for the year.
- [4]80%Claude Sonnet 4.6 Brings Improved Coding, Computer Use, and Office Tasksmacrumors.com· صدر 17 فبراير 2026· يبدأ 17 فبراير 2026· 13% من الدرجة
MacRumors, 2026-02-17: "Anthropic[1][5] today updated its Sonnet model to version 4.6", available on all Claude[2] plans, with file creation, connectors, skills and compaction added for free users; Opus 4.6 stays the better choice for the hardest agentic work.
- [5]90%System Card: Claude Sonnet 4.6anthropic.com· صدر 17 فبراير 2026· 13% من الدرجة
Anthropic's[1] system card dated "February 17, 2026", which records the model's release under the AI Safety Level 3 (ASL-3) Standard; a 6 March 2026 changelog entry updated its BrowseComp scores after an improved cheating-detection pipeline.
اقتراح تصحيح
هل ينقص شيء أو يوجد خطأ؟ قله بكلماتك: رابط يدعم هذا الدبوس، أو تاريخ بدء أو انتهاء مختلف مع السبب، أو معلومة ينقصها أو يخطئ فيها. يفحص الذكاء الاصطناعي ذلك بمقارنته بمصادر هذا الدبوس، ويبحث عن مصادر أفضل، ويضيف أي صفحة تدعم كلامك. وتبقى مصادر الدبوس نفسه الأثقل وزنًا. كما تُفحص الصورة التي تُظهر شيئًا آخر أو تُظهره بشكل سيئ، فتُنزَّل أو تُستبدل.