- शुरुआत
- 4 मार्च 202495% कॉन्फ़िडेंसanthropic.com से
Anthropic ने Claude 3 Sonnet रिलीज़ किया
मूल भाषा से अपने आप अनुवादित
मूल शीर्षक: Claude 3 Sonnet Released
- Anthropic ने 4 मार्च 2024 को Claude 3 फ़ैमिली की घोषणा की - Haiku, Sonnet और Opus - जिसमें Opus और Sonnet "अब claude.ai और Claude API में इस्तेमाल के लिए उपलब्ध" हो गए, जो 159 देशों में सामान्य रूप से उपलब्ध हुआ; Haiku बाद में आना था[3]
- Sonnet "claude.ai पर फ़्री एक्सपीरियंस" को चलाता है, जबकि Opus, Claude Pro सब्सक्राइबर्स के लिए रखा गया, और यह उसी दिन Amazon Bedrock पर और Google Cloud के Vertex AI Model Garden पर प्राइवेट प्रीव्यू में लॉन्च हुआ[3][4]
- Anthropic ने इसे उस मॉडल के तौर पर पेश किया जो "बुद्धिमत्ता और स्पीड के बीच सबसे सही बैलेंस बनाता है—खासकर एंटरप्राइज़ वर्कलोड के लिए", और ज़्यादातर वर्कलोड के लिए Claude 2 और Claude 2.1 से दोगुना तेज़[3][4]
- यह फ़ैमिली Anthropic की Responsible Scaling Policy के तहत AI Safety Level 2 (ASL-2) पर रही, और अपने गार्डरेल के पास हानिरहित प्रॉम्प्ट को पहले के Claude मॉडलों की तुलना में बहुत कम बार मना करती है[3]
- जब Anthropic ने जुलाई 2025 में Claude 3 Sonnet को रिटायर किया, तो लगभग 200 लोग San Francisco में एक "फ़्यूनरल" के लिए इकट्ठा हुए[2]
प्रमुख विशेषताएँ
- कीमत $3 प्रति मिलियन इनपुट टोकन और $15 प्रति मिलियन आउटपुट टोकन, 200K-टोकन कॉन्टेक्स्ट विंडो के साथ[3]
- विज़न वाली पहली Claude पीढ़ी: यह फ़ोटो, चार्ट, ग्राफ़ और टेक्निकल डायग्राम पढ़ती है, एक रिक्वेस्ट में 20 इमेज तक, हालाँकि Anthropic ने इसे लोगों की पहचान करने से रोका[1][5]
- मॉडल कार्ड के बेंचमार्क: MMLU (5-shot) पर 79.0%, GPQA Diamond पर 40.4%, GSM8K पर 92.3% और HumanEval Python कोडिंग पर 73.0%[1]
- Amazon Web Services और Google Cloud के हार्डवेयर पर PyTorch, JAX और Triton के साथ ट्रेन किया गया; यह अगस्त 2023 से पहले के डेटा से जवाब देता है और वेब सर्च नहीं कर सकता[1][5]
- Anthropic के सुझाए इस्तेमाल: बड़े नॉलेज बेस पर रिट्रीवल, प्रोडक्ट रिकमेंडेशन और फ़ोरकास्टिंग, कोड जनरेशन और इमेज से टेक्स्ट पार्स करना[3]
बेंचमार्क[3]
| बेंचमार्क | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| अंडरग्रेजुएट-स्तर का नॉलेज (MMLU) | 86.8% (5-shot) | 79.0% (5-shot) | 75.2% (5-shot) | 86.4% (5-shot) | 70.0% (5-shot) | 83.7% (5-shot) | 71.8% (5-shot) |
| ग्रेजुएट-स्तर रीज़निंग (GPQA, Diamond) | 50.4% (0-shot CoT) | 40.4% (0-shot CoT) | 33.3% (0-shot CoT) | 35.7% (0-shot CoT) | 28.1% (0-shot CoT) | — | — |
| ग्रेड स्कूल गणित (GSM8K) | 95.0% (0-shot CoT) | 92.3% (0-shot CoT) | 88.9% (0-shot CoT) | 92.0% (5-shot CoT) | 57.1% (5-shot) | 94.4% (Maj1@32) | 86.5% (Maj1@32) |
| गणित समस्या-समाधान (MATH) | 60.1% (0-shot CoT) | 43.1% (0-shot CoT) | 38.9% (0-shot CoT) | 52.9% (4-shot) | 34.1% (4-shot) | 53.2% (4-shot) | 32.6% (4-shot) |
| बहुभाषी गणित (MGSM) | 90.7% (0-shot) | 83.5% (0-shot) | 75.1% (0-shot) | 74.5% (8-shot) | — | 79.0% (8-shot) | 63.5% (8-shot) |
| कोड (HumanEval) | 84.9% (0-shot) | 73.0% (0-shot) | 75.9% (0-shot) | 67.0% (0-shot) | 48.1% (0-shot) | 74.4% (0-shot) | 67.7% (0-shot) |
| टेक्स्ट पर रीज़निंग (DROP, F1 स्कोर) | 83.1 (3-shot) | 78.9 (3-shot) | 78.4 (3-shot) | 80.9 (3-shot) | 64.1 (3-shot) | 82.4 (variable shots) | 74.1 (variable shots) |
| मिश्रित इवैल्यूएशन (BIG-Bench-Hard) | 86.8% (3-shot CoT) | 82.9% (3-shot CoT) | 73.7% (3-shot CoT) | 83.1% (3-shot CoT) | 66.6% (3-shot CoT) | 83.6% (3-shot CoT) | 75.0% (3-shot CoT) |
| नॉलेज Q&A (ARC-Challenge) | 96.4% (25-shot) | 93.2% (25-shot) | 89.2% (25-shot) | 96.3% (25-shot) | 85.2% (25-shot) | — | — |
| सामान्य ज्ञान (HellaSwag) | 95.4% (10-shot) | 89.0% (10-shot) | 85.9% (10-shot) | 95.3% (10-shot) | 85.5% (10-shot) | 87.8% (10-shot) | 84.7% (10-shot) |
संदर्भ 583% कॉन्फ़िडेंसकुल भरोसा: 83%पिन का स्रोत और संदर्भ उसकी तारीखों की कितनी पुष्टि करते हैं।सोर्स सहित 5 संदर्भ पिन के शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करते हैं, इसका भारित औसत; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है75% या उससे बेहतर कॉन्फ़िडेंस वाले सभी पिन दिखाएं
पहली एंट्री हमेशा पिन का सोर्स होती है। कुल कॉन्फ़िडेंस एक भारित औसत है कि हर संदर्भ ऊपर इस्तेमाल किए गए शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करता है; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है।
- [1]90%anthropic.com/claude-3-model-cardanthropic.com· 28 सित॰ 2026 को पोस्ट किया गया· शुरुआत 4 मार्च 2024· स्कोर का 48%
मॉडल कार्ड पर कोई लॉन्च तारीख़ नहीं है, इसलिए तारीख़ लॉन्च पोस्ट की है: 'Introducing the next generation of Claude, Mar 4, 2024' - 'Opus और Sonnet अब claude.ai और Claude API में इस्तेमाल के लिए उपलब्ध हैं'; AWS की 04 MAR 2024 की पोस्ट में घोषणा है 'आज Amazon[4] Bedrock में Anthropic[3] के Claude 3 Sonnet की उपलब्धता'।
- [2]75%Claude (AI) - Wikipediaen.wikipedia.org· 28 सित॰ 2026 को जोड़ा गया· स्कोर का 48%
The Sonnet table lists Claude 3 Sonnet as released 4 March 2024 and discontinued; the article adds that when Anthropic[1][3] retired it in July 2025 around 200 people gathered in San Francisco for a "funeral".
- [3]95%Introducing the next generation of Claudeanthropic.com· 4 मार्च 2024 को प्रकाशित· शुरुआत 4 मार्च 2024 ✓· स्कोर का 1%
Anthropic's[1] launch post, dated "Mar 4, 2024": "Opus and Sonnet are now available to use in claude.ai and the Claude API which is now generally available in 159 countries", with Sonnet at $3/$15 per million tokens and a 200K context window, powering the free claude.ai. The model card that is the source carries no launch date, so this row dates the pin.
- [4]90%Anthropic's Claude 3 Sonnet foundation model is now available in Amazon Bedrockaws.amazon.com· 4 मार्च 2024 को प्रकाशित· शुरुआत 4 मार्च 2024· स्कोर का 1%
AWS News Blog post by Channy Yun, 04 MAR 2024: "We're also announcing the availability of Anthropic's[1][3] Claude 3 Sonnet today in Amazon Bedrock, with Claude 3 Opus and Claude 3 Haiku coming soon"; Sonnet is two times faster than Claude 2 and 2.1.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· 4 मार्च 2024 को प्रकाशित· शुरुआत 4 मार्च 2024· स्कोर का 1%
TechCrunch's same-day report: Opus and Sonnet "are available now on the web and via Anthropic's[1][3] dev console and API, Amazon's[4] Bedrock platform and Google's Vertex AI"; Claude 3 is Anthropic's first multimodal model, takes up to 20 images per request, cannot identify people and answers only from data before August 2023.
सुधार सुझाएं
कुछ छूट गया या गलत है? अपने शब्दों में बताएं: कोई लिंक जो इस पिन का समर्थन करता हो, कोई अलग शुरुआत या खत्म होने की तारीख और उसकी वजह, या कोई तथ्य जो छूट गया हो या गलत हो। AI इसे इस पिन के सोर्स से मिलाकर जांचता है, बेहतर सोर्स खोजता है, और जो भी पेज आपकी बात का समर्थन करता है उसे जोड़ देता है। पिन के अपने सोर्स की अहमियत फिर भी सबसे ज़्यादा रहती है। AI तस्वीरें भी देखता है: जो तस्वीर कुछ और दिखाती हो या ठीक से न दिखाती हो, उसे नीचे कर दिया जाता है या बदल दिया जाता है।