- البدء
- 4 مارس 2024ثقة 95%من anthropic.com
إطلاق Claude 3 Sonnet
تُرجم تلقائيًا من الأصل
العنوان الأصلي: Claude 3 Sonnet Released
- أعلنت Anthropic عائلة Claude 3 - Haiku وSonnet وOpus - في 4 مارس 2024، مع إتاحة Opus وSonnet «للاستخدام الآن على claude.ai وClaude API» التي أصبحت متاحة للعموم في 159 دولة؛ على أن يلحق بهما Haiku[3]
- يشغّل Sonnet «التجربة المجانية على claude.ai»، بينما اقتصر Opus على مشتركي Claude Pro، وأُطلق في اليوم نفسه على Amazon Bedrock وفي معاينة خاصة على Vertex AI Model Garden التابعة لـGoogle Cloud[3][4]
- قدمته Anthropic بوصفه النموذج الذي «يحقق التوازن المثالي بين الذكاء والسرعة - خصوصاً لأعباء عمل المؤسسات»، وأسرع مرتين من Claude 2 وClaude 2.1 في معظم أعباء العمل[3][4]
- بقيت العائلة عند مستوى أمان الذكاء الاصطناعي 2 (ASL-2) بموجب سياسة التوسع المسؤول لدى Anthropic، وترفض الأوامر غير الضارة القريبة من حدود الضوابط بوتيرة أقل بكثير من نماذج Claude السابقة[3]
- عندما سحبت Anthropic Claude 3 Sonnet في يوليو 2025، اجتمع نحو 200 شخص في سان فرانسيسكو في «جنازة» له[2]
أبرز الميزات
- بسعر 3 دولارات لكل مليون رمز إدخال و15 دولاراً لكل مليون رمز إخراج، مع نافذة سياق من 200K رمز[3]
- أول جيل من Claude بقدرات الرؤية: يقرأ الصور الفوتوغرافية والمخططات والرسوم البيانية والرسوم الفنية التقنية، حتى 20 صورة في الطلب الواحد، وإن منعته Anthropic من التعرف على الأشخاص[1][5]
- نتائج بطاقة النموذج: 79.0% في MMLU (5-shot) و40.4% في GPQA Diamond و92.3% في GSM8K و73.0% في HumanEval لبرمجة Python[1]
- دُرّب على عتاد Amazon Web Services وGoogle Cloud باستخدام PyTorch وJAX وTriton؛ ويجيب من بيانات تسبق أغسطس 2023 ولا يستطيع البحث على الويب[1][5]
- استخدامات تقترحها Anthropic: الاسترجاع من قواعد معرفة كبيرة، وتوصيات المنتجات والتنبؤ، وتوليد الشيفرة البرمجية، واستخراج النصوص من الصور[3]
نتائج الاختبارات[3]
| الاختبار | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| معرفة بمستوى المرحلة الجامعية (MMLU) | 86.8% (5-shot) | 79.0% (5-shot) | 75.2% (5-shot) | 86.4% (5-shot) | 70.0% (5-shot) | 83.7% (5-shot) | 71.8% (5-shot) |
| استدلال بمستوى الدراسات العليا (GPQA, Diamond) | 50.4% (0-shot CoT) | 40.4% (0-shot CoT) | 33.3% (0-shot CoT) | 35.7% (0-shot CoT) | 28.1% (0-shot CoT) | — | — |
| رياضيات المرحلة الابتدائية (GSM8K) | 95.0% (0-shot CoT) | 92.3% (0-shot CoT) | 88.9% (0-shot CoT) | 92.0% (5-shot CoT) | 57.1% (5-shot) | 94.4% (Maj1@32) | 86.5% (Maj1@32) |
| حل المسائل الرياضية (MATH) | 60.1% (0-shot CoT) | 43.1% (0-shot CoT) | 38.9% (0-shot CoT) | 52.9% (4-shot) | 34.1% (4-shot) | 53.2% (4-shot) | 32.6% (4-shot) |
| رياضيات متعددة اللغات (MGSM) | 90.7% (0-shot) | 83.5% (0-shot) | 75.1% (0-shot) | 74.5% (8-shot) | — | 79.0% (8-shot) | 63.5% (8-shot) |
| البرمجة (HumanEval) | 84.9% (0-shot) | 73.0% (0-shot) | 75.9% (0-shot) | 67.0% (0-shot) | 48.1% (0-shot) | 74.4% (0-shot) | 67.7% (0-shot) |
| الاستدلال على النصوص (DROP, F1 score) | 83.1 (3-shot) | 78.9 (3-shot) | 78.4 (3-shot) | 80.9 (3-shot) | 64.1 (3-shot) | 82.4 (variable shots) | 74.1 (variable shots) |
| تقييمات متنوعة (BIG-Bench-Hard) | 86.8% (3-shot CoT) | 82.9% (3-shot CoT) | 73.7% (3-shot CoT) | 83.1% (3-shot CoT) | 66.6% (3-shot CoT) | 83.6% (3-shot CoT) | 75.0% (3-shot CoT) |
| أسئلة وأجوبة معرفية (ARC-Challenge) | 96.4% (25-shot) | 93.2% (25-shot) | 89.2% (25-shot) | 96.3% (25-shot) | 85.2% (25-shot) | — | — |
| المعرفة العامة (HellaSwag) | 95.4% (10-shot) | 89.0% (10-shot) | 85.9% (10-shot) | 95.3% (10-shot) | 85.5% (10-shot) | 87.8% (10-shot) | 84.7% (10-shot) |
المراجع 5ثقة 83%الثقة الإجمالية: 83%مدى دعم مصدر الدبوس ومراجعه لتواريخه.متوسط مرجّح لمدى قوة دعم 5 مراجع، بما فيها المصدر، لوقتَي بدء الدبوس وانتهائه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجععرض كل الدبابيس بثقة 75% أو أعلى
المدخل الأول هو دائمًا مصدر الدبوس. الثقة الإجمالية متوسط مرجّح لمدى قوة دعم كل مرجع لوقتَي البدء والانتهاء المستخدمين أعلاه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجع.
- [1]90%anthropic.com/claude-3-model-cardanthropic.com· نُشر 28 سبتمبر 2026· يبدأ 4 مارس 2024· 48% من الدرجة
لا تحمل بطاقة النموذج تاريخ إطلاق، لذا فالتاريخ هو تاريخ منشور الإطلاق: «نقدم الجيل التالي من Claude، 4 مارس 2024» - «Opus وSonnet متاحان الآن للاستخدام على claude.ai وClaude API»؛ وتعلن منشورة AWS بتاريخ 04 MAR 2024 «توفر Claude 3 Sonnet من Anthropic[3] اليوم على Amazon[4] Bedrock».
- [2]75%Claude (AI) - Wikipediaen.wikipedia.org· أُضيف 28 سبتمبر 2026· 48% من الدرجة
The Sonnet table lists Claude 3 Sonnet as released 4 March 2024 and discontinued; the article adds that when Anthropic[1][3] retired it in July 2025 around 200 people gathered in San Francisco for a "funeral".
- [3]95%Introducing the next generation of Claudeanthropic.com· صدر 4 مارس 2024· يبدأ 4 مارس 2024 ✓· 1% من الدرجة
Anthropic's[1] launch post, dated "Mar 4, 2024": "Opus and Sonnet are now available to use in claude.ai and the Claude API which is now generally available in 159 countries", with Sonnet at $3/$15 per million tokens and a 200K context window, powering the free claude.ai. The model card that is the source carries no launch date, so this row dates the pin.
- [4]90%Anthropic's Claude 3 Sonnet foundation model is now available in Amazon Bedrockaws.amazon.com· صدر 4 مارس 2024· يبدأ 4 مارس 2024· 1% من الدرجة
AWS News Blog post by Channy Yun, 04 MAR 2024: "We're also announcing the availability of Anthropic's[1][3] Claude 3 Sonnet today in Amazon Bedrock, with Claude 3 Opus and Claude 3 Haiku coming soon"; Sonnet is two times faster than Claude 2 and 2.1.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· صدر 4 مارس 2024· يبدأ 4 مارس 2024· 1% من الدرجة
TechCrunch's same-day report: Opus and Sonnet "are available now on the web and via Anthropic's[1][3] dev console and API, Amazon's[4] Bedrock platform and Google's Vertex AI"; Claude 3 is Anthropic's first multimodal model, takes up to 20 images per request, cannot identify people and answers only from data before August 2023.
اقتراح تصحيح
هل ينقص شيء أو يوجد خطأ؟ قله بكلماتك: رابط يدعم هذا الدبوس، أو تاريخ بدء أو انتهاء مختلف مع السبب، أو معلومة ينقصها أو يخطئ فيها. يفحص الذكاء الاصطناعي ذلك بمقارنته بمصادر هذا الدبوس، ويبحث عن مصادر أفضل، ويضيف أي صفحة تدعم كلامك. وتبقى مصادر الدبوس نفسه الأثقل وزنًا. كما تُفحص الصورة التي تُظهر شيئًا آخر أو تُظهره بشكل سيئ، فتُنزَّل أو تُستبدل.