- शुरुआत
- 4 नव॰ 202492% कॉन्फ़िडेंसplatform.claude.com से
Anthropic ने Claude 3.5 Haiku रिलीज़ किया
मूल भाषा से अपने आप अनुवादित
मूल शीर्षक: Claude 3.5 Haiku Released
- Anthropic ने 22 अक्टूबर 2024 को अपग्रेड किए गए Claude 3.5 Sonnet और कंप्यूटर यूज़ के साथ Claude 3.5 Haiku की घोषणा की, और इसे 4 नवंबर को Claude API, Amazon Bedrock और Google Cloud के Vertex AI पर रिलीज़ किया[2][5][6]
- यह $1 प्रति मिलियन इनपुट टोकन और $5 प्रति मिलियन आउटपुट टोकन पर लॉन्च हुआ, जो Claude 3 Haiku की कीमत से चार गुना है, जब Anthropic ने कहा कि फ़ाइनल टेस्टिंग में इसने "कई बेंचमार्क पर हमारे पिछले फ़्लैगशिप मॉडल, Claude 3 Opus को पीछे छोड़ दिया"[4]
- यह टेक्स्ट-ओनली आया; Claude 3 Haiku उन यूज़र्स के लिए उपलब्ध रहा जिन्हें "अधिकतम कॉस्ट-एफ़िशिएंसी और इमेज प्रोसेसिंग" की ज़रूरत थी, और विज़न सपोर्ट 24 फ़रवरी 2025 को आया[2][4]
- Anthropic ने 3 दिसंबर 2024 को की गई एक अपडेट में कीमत $0.80 और $4 प्रति मिलियन टोकन कर दी[6]
- 19 दिसंबर 2025 को डिप्रिकेट किया गया और 19 फ़रवरी 2026 को Claude API से रिटायर कर दिया गया, जिसकी जगह Claude Haiku 4.5 ने ली[3]
प्रमुख विशेषताएँ
- Anthropic के सबसे तेज़ मॉडल की अगली पीढ़ी: Claude 3 Haiku जैसी स्पीड पर यह "हर स्किल सेट में सुधार करता है" और कई मामलों में शुरुआती Claude 3.5 Sonnet और Claude 3 Opus के बराबर पहुँच जाता है[1][6]
- कोडिंग: SWE-bench Verified पर 40.6%, जो शुरुआती Claude 3.5 Sonnet के 33.4% और Claude 3 Opus के 22.2% से ज़्यादा है, और Anthropic के इंटरनल एजेंटिक कोडिंग टेस्ट पर 74%, जबकि Opus का 38% था[1][6]
- अन्य बताए गए स्कोर: HumanEval पर 88.1%, GPQA Diamond पर 41.6%, MMLU Pro पर 65.0% और TAU-bench रिटेल पर 51.0%, जबकि Claude 3 Haiku के 75.9%, 33.3%, 49.0% और 18.2% थे[1]
- जुलाई 2024 का नॉलेज कटऑफ़, जो Claude 3 Haiku से ज़्यादा हाल का है, और लंबे आउटपुट; इसे यूज़र-फ़ेसिंग प्रोडक्ट, सब-एजेंट टास्क और बड़े डेटासेट से पर्सनलाइज़ेशन के लिए पेश किया गया है[1][4][6]
बेंचमार्क[6]
| बेंचमार्क | Claude 3.5 Sonnet (new) | Claude 3.5 Haiku | Claude 3.5 Sonnet | GPT-4o* | GPT-4o mini* | Gemini 1.5 Pro | Gemini 1.5 Flash |
|---|---|---|---|---|---|---|---|
| GPQA (Diamond) (ग्रेजुएट-स्तर रीज़निंग) | 65.0% 0-shot CoT | 41.6% 0-shot CoT | 59.4% 0-shot CoT | 53.6% 0-shot CoT | 40.2% 0-shot CoT | 59.1% 0-shot CoT | 51.0% 0-shot CoT |
| MMLU Pro (अंडरग्रेजुएट-स्तर का नॉलेज) | 78.0% 0-shot CoT | 65.0% 0-shot CoT | 75.1% 0-shot CoT | — | — | 75.8% 0-shot CoT | 67.3% 0-shot CoT |
| HumanEval (कोड) | 93.7% 0-shot | 88.1% 0-shot | 92.0% 0-shot | 90.2% 0-shot | 87.2% 0-shot | — | — |
| MATH (गणित समस्या-समाधान) | 78.3% 0-shot CoT | 69.2% 0-shot CoT | 71.1% 0-shot CoT | 76.6% 0-shot CoT | 70.2% 0-shot CoT | 86.5% 4-shot CoT | 77.9% 4-shot CoT |
| AIME 2024 (हाई स्कूल गणित प्रतियोगिता) | 16.0% 0-shot CoT | 5.3% 0-shot CoT | 9.6% 0-shot CoT | 9.3% 0-shot CoT | — | — | — |
| MMMU (विज़ुअल Q/A) | 70.4% 0-shot CoT | — | 68.3% 0-shot CoT | 69.1% 0-shot CoT | 59.4% 0-shot CoT | 65.9% 0-shot CoT | 62.3% 0-shot CoT |
| SWE-bench Verified (एजेंटिक कोडिंग) | 49.0% | 40.6% | 33.4% | — | — | — | — |
| TAU-bench (एजेंटिक टूल यूज़) | रिटेल 69.2%, एयरलाइन 46.0% | रिटेल 51.0%, एयरलाइन 22.8% | रिटेल 62.6%, एयरलाइन 36.0% | — | — | — | — |
* Anthropic की इवैल्यूएशन टेबल OpenAI के o1 मॉडल फ़ैमिली को शामिल नहीं करती, जो जवाब देने से पहले बड़े पैमाने पर कंप्यूटेशन टाइम पर निर्भर करता है, जिससे तुलना मुश्किल हो जाती है।
संदर्भ 690% कॉन्फ़िडेंसकुल भरोसा: 90%पिन का स्रोत और संदर्भ उसकी तारीखों की कितनी पुष्टि करते हैं।सोर्स सहित 6 संदर्भ पिन के शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करते हैं, इसका भारित औसत; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है75% या उससे बेहतर कॉन्फ़िडेंस वाले सभी पिन दिखाएं
पहली एंट्री हमेशा पिन का सोर्स होती है। कुल कॉन्फ़िडेंस एक भारित औसत है कि हर संदर्भ ऊपर इस्तेमाल किए गए शुरू और खत्म होने के समय का कितनी मज़बूती से समर्थन करता है; सबसे नए संदर्भ से हर 180 दिन पुराना होने पर किसी संदर्भ की गिनती आधी हो जाती है।
- [1]90%assets.anthropic.com/m/1cd9d098ac3e6467/original/Claude-3-Model-Card-October-Addendum.pdfassets.anthropic.com· 28 सित॰ 2026 को पोस्ट किया गया· शुरुआत 4 नव॰ 2024· स्कोर का 31%
Claude[2][3] के रिलीज़ नोट्स: 'November 4th, 2024 Claude Haiku 3.5 अब Claude API पर एक टेक्स्ट-ओनली मॉडल के तौर पर उपलब्ध है'; TechCrunch[4] (10:24 AM PST, 4 नवंबर 2024) लिखता है 'Anthropic[6] का नया AI मॉडल आ गया है' और AWS ने उसी दिन Bedrock पर उपलब्धता पोस्ट की। 22 अक्टूबर की पोस्ट में कहा गया था कि यह 'इस महीने के बाद में रिलीज़ होगा'।
- [2]92%Claude Platform release notes - Claude Platform Docsplatform.claude.com· 28 सित॰ 2026 को जोड़ा गया· शुरुआत 4 नव॰ 2024 ✓· स्कोर का 31%
Anthropic's[1][6] own dated changelog: "November 4th, 2024 Claude[3] Haiku 3.5 is now available on the Claude API as a text-only model", and on 24 February 2025 "We've added vision support to Claude Haiku 3.5". The model card addendum that is the source carries no release date, so this entry dates the pin.
- [3]90%Model deprecations - Claude Platform Docsplatform.claude.com· 28 सित॰ 2026 को जोड़ा गया· स्कोर का 31%
Anthropic[1][6] notified developers on 19 December 2025 that Claude[2] Haiku 3.5 (claude-3-5-haiku-20241022) would be retired; it was retired on 19 February 2026, with claude-haiku-4-5-20251001 as the replacement.
- [4]88%Anthropic hikes the price of its Haiku modeltechcrunch.com· 4 नव॰ 2024 को प्रकाशित· शुरुआत 4 नव॰ 2024· स्कोर का 2%
TechCrunch (Kyle Wiggers, 10:24 AM PST, 4 November 2024): "Anthropic's[1][6] newest AI model has arrived"; it costs $1 per million input and $5 per million output tokens against Claude[2][3] 3 Haiku's $0.25 and $1.25, "a 4x hike", quoting Anthropic that "we've increased pricing for Claude 3.5 Haiku to reflect its increase in intelligence", and it launches without image analysis.
- [5]85%Anthropic's Claude 3.5 Haiku model now available in Amazon Bedrockaws.amazon.com· 4 नव॰ 2024 को प्रकाशित· शुरुआत 4 नव॰ 2024· स्कोर का 2%
AWS What's New, "Posted on: Nov 4, 2024": Claude[2][3] 3.5 Haiku is now available in Amazon Bedrock and "surpasses even Claude 3 Opus, the largest model in Anthropic's[1][6] previous generation, on many intelligence benchmarks—including coding".
सुधार सुझाएं
कुछ छूट गया या गलत है? अपने शब्दों में बताएं: कोई लिंक जो इस पिन का समर्थन करता हो, कोई अलग शुरुआत या खत्म होने की तारीख और उसकी वजह, या कोई तथ्य जो छूट गया हो या गलत हो। AI इसे इस पिन के सोर्स से मिलाकर जांचता है, बेहतर सोर्स खोजता है, और जो भी पेज आपकी बात का समर्थन करता है उसे जोड़ देता है। पिन के अपने सोर्स की अहमियत फिर भी सबसे ज़्यादा रहती है। AI तस्वीरें भी देखता है: जो तस्वीर कुछ और दिखाती हो या ठीक से न दिखाती हो, उसे नीचे कर दिया जाता है या बदल दिया जाता है।