- เริ่ม
- 4 พ.ย. 2024ความเชื่อมั่น 92%จาก platform.claude.com
เปิดตัว Claude 3.5 Haiku
แปลอัตโนมัติจากต้นฉบับ
ชื่อต้นฉบับ: Claude 3.5 Haiku Released
- Anthropic ประกาศ Claude 3.5 Haiku เมื่อวันที่ 22 ตุลาคม 2024 พร้อมกับ Claude 3.5 Sonnet ที่อัปเกรดและการใช้คอมพิวเตอร์ และเปิดตัวเมื่อวันที่ 4 พฤศจิกายนบน Claude API, Amazon Bedrock และ Vertex AI ของ Google Cloud[2][5][6]
- เปิดตัวที่ 1 ดอลลาร์ต่อหนึ่งล้านโทเค็นอินพุต และ 5 ดอลลาร์ต่อหนึ่งล้านโทเค็นเอาต์พุต สี่เท่าของราคา Claude 3 Haiku หลัง Anthropic ระบุว่าในการทดสอบขั้นสุดท้ายโมเดล “เหนือกว่า Claude 3 Opus โมเดลเรือธงรุ่นก่อนของเรา ในเกณฑ์วัดหลายรายการ”[4]
- เปิดตัวแบบรับเฉพาะข้อความ โดย Claude 3 Haiku ยังคงให้บริการสำหรับผู้ใช้ที่ต้องการ “ประสิทธิภาพด้านต้นทุนสูงสุดและการประมวลผลภาพ” และรองรับการมองเห็นมาในวันที่ 24 กุมภาพันธ์ 2025[2][4]
- Anthropic ลดราคาเป็น 0.80 ดอลลาร์และ 4 ดอลลาร์ต่อหนึ่งล้านโทเค็นในการอัปเดตลงวันที่ 3 ธันวาคม 2024[6]
- ประกาศเลิกสนับสนุนเมื่อวันที่ 19 ธันวาคม 2025 และเลิกใช้จาก Claude API เมื่อวันที่ 19 กุมภาพันธ์ 2026 โดยมี Claude Haiku 4.5 มาแทน[3]
จุดเด่น
- โมเดลที่เร็วที่สุดของ Anthropic รุ่นถัดไป: ด้วยความเร็วใกล้เคียงกับ Claude 3 Haiku โมเดล “ปรับปรุงทุกชุดทักษะ” และในหลายกรณีเทียบเท่า Claude 3.5 Sonnet ตัวดั้งเดิมและ Claude 3 Opus[1][6]
- การเขียนโค้ด: 40.6% ใน SWE-bench Verified สูงกว่า 33.4% ของ Claude 3.5 Sonnet ตัวดั้งเดิม และ 22.2% ของ Claude 3 Opus และ 74% ในการทดสอบการเขียนโค้ดแบบเอเจนต์ภายในของ Anthropic เทียบกับ 38% ของ Opus[1][6]
- คะแนนอื่นที่รายงาน: 88.1% ใน HumanEval, 41.6% ใน GPQA Diamond, 65.0% ใน MMLU Pro และ 51.0% ใน TAU-bench หมวดค้าปลีก เทียบกับ 75.9%, 33.3%, 49.0% และ 18.2% ของ Claude 3 Haiku[1]
- ข้อมูลความรู้ถึงเดือนกรกฎาคม 2024 ใหม่กว่า Claude 3 Haiku และเอาต์พุตยาวขึ้น วางตำแหน่งสำหรับผลิตภัณฑ์ที่ผู้ใช้โต้ตอบโดยตรง งานเอเจนต์ย่อย และการปรับแต่งเฉพาะบุคคลจากชุดข้อมูลขนาดใหญ่[1][4][6]
เกณฑ์วัด[6]
| เกณฑ์วัด | Claude 3.5 Sonnet (ใหม่) | Claude 3.5 Haiku | Claude 3.5 Sonnet | GPT-4o* | GPT-4o mini* | Gemini 1.5 Pro | Gemini 1.5 Flash |
|---|---|---|---|---|---|---|---|
| GPQA (Diamond) (การให้เหตุผลระดับบัณฑิตศึกษา) | 65.0% 0-shot CoT | 41.6% 0-shot CoT | 59.4% 0-shot CoT | 53.6% 0-shot CoT | 40.2% 0-shot CoT | 59.1% 0-shot CoT | 51.0% 0-shot CoT |
| MMLU Pro (ความรู้ระดับปริญญาตรี) | 78.0% 0-shot CoT | 65.0% 0-shot CoT | 75.1% 0-shot CoT | — | — | 75.8% 0-shot CoT | 67.3% 0-shot CoT |
| HumanEval (โค้ด) | 93.7% 0-shot | 88.1% 0-shot | 92.0% 0-shot | 90.2% 0-shot | 87.2% 0-shot | — | — |
| MATH (การแก้โจทย์คณิตศาสตร์) | 78.3% 0-shot CoT | 69.2% 0-shot CoT | 71.1% 0-shot CoT | 76.6% 0-shot CoT | 70.2% 0-shot CoT | 86.5% 4-shot CoT | 77.9% 4-shot CoT |
| AIME 2024 (การแข่งขันคณิตศาสตร์ระดับมัธยม) | 16.0% 0-shot CoT | 5.3% 0-shot CoT | 9.6% 0-shot CoT | 9.3% 0-shot CoT | — | — | — |
| MMMU (ถาม-ตอบจากภาพ) | 70.4% 0-shot CoT | — | 68.3% 0-shot CoT | 69.1% 0-shot CoT | 59.4% 0-shot CoT | 65.9% 0-shot CoT | 62.3% 0-shot CoT |
| SWE-bench Verified (การเขียนโค้ดแบบเอเจนต์) | 49.0% | 40.6% | 33.4% | — | — | — | — |
| TAU-bench (การใช้เครื่องมือแบบเอเจนต์) | ค้าปลีก 69.2%, สายการบิน 46.0% | ค้าปลีก 51.0%, สายการบิน 22.8% | ค้าปลีก 62.6%, สายการบิน 36.0% | — | — | — | — |
* ตารางประเมินของ Anthropic ไม่รวมตระกูลโมเดล o1 ของ OpenAI ซึ่งต้องใช้เวลาคำนวณก่อนตอบอย่างมากและทำให้การเปรียบเทียบยาก
แหล่งอ้างอิง 6ความเชื่อมั่น 90%ความเชื่อมั่นโดยรวม: 90%แหล่งที่มาและแหล่งอ้างอิงของหมุดยืนยันวันที่ได้ดีเพียงใดค่าเฉลี่ยถ่วงน้ำหนักว่าแหล่งอ้างอิง 6 แหล่ง รวมแหล่งที่มา สนับสนุนเวลาเริ่มและสิ้นสุดของหมุดมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุดแสดงหมุดทั้งหมดที่มีความเชื่อมั่น 75% ขึ้นไป
รายการแรกคือแหล่งที่มาของหมุดเสมอ ความเชื่อมั่นโดยรวมคือค่าเฉลี่ยถ่วงน้ำหนักว่าแต่ละแหล่งอ้างอิงสนับสนุนเวลาเริ่มและสิ้นสุดด้านบนมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุด
- [1]90%assets.anthropic.com/m/1cd9d098ac3e6467/original/Claude-3-Model-Card-October-Addendum.pdfassets.anthropic.com· โพสต์ 28 ก.ย. 2026· เริ่ม 4 พ.ย. 2024· 31% ของคะแนน
บันทึกการเปิดตัวของ Claude[2][3]: “4 พฤศจิกายน 2024 Claude Haiku 3.5 พร้อมใช้งานแล้วบน Claude API ในฐานะโมเดลที่รับเฉพาะข้อความ” TechCrunch[4] (10:24 น. ตามเวลา PST วันที่ 4 พฤศจิกายน 2024) รายงานว่า “โมเดล AI ใหม่ล่าสุดของ Anthropic[6] มาถึงแล้ว” และ AWS ประกาศความพร้อมบน Bedrock ในวันเดียวกัน โพสต์วันที่ 22 ตุลาคมเคยระบุว่า “จะเปิดตัวในช่วงปลายเดือนนี้”
- [2]92%Claude Platform release notes - Claude Platform Docsplatform.claude.com· เพิ่มเมื่อ 28 ก.ย. 2026· เริ่ม 4 พ.ย. 2024 ✓· 31% ของคะแนน
Anthropic's[1][6] own dated changelog: "November 4th, 2024 Claude[3] Haiku 3.5 is now available on the Claude API as a text-only model", and on 24 February 2025 "We've added vision support to Claude Haiku 3.5". The model card addendum that is the source carries no release date, so this entry dates the pin.
- [3]90%Model deprecations - Claude Platform Docsplatform.claude.com· เพิ่มเมื่อ 28 ก.ย. 2026· 31% ของคะแนน
Anthropic[1][6] notified developers on 19 December 2025 that Claude[2] Haiku 3.5 (claude-3-5-haiku-20241022) would be retired; it was retired on 19 February 2026, with claude-haiku-4-5-20251001 as the replacement.
- [4]88%Anthropic hikes the price of its Haiku modeltechcrunch.com· เผยแพร่ 4 พ.ย. 2024· เริ่ม 4 พ.ย. 2024· 2% ของคะแนน
TechCrunch (Kyle Wiggers, 10:24 AM PST, 4 November 2024): "Anthropic's[1][6] newest AI model has arrived"; it costs $1 per million input and $5 per million output tokens against Claude[2][3] 3 Haiku's $0.25 and $1.25, "a 4x hike", quoting Anthropic that "we've increased pricing for Claude 3.5 Haiku to reflect its increase in intelligence", and it launches without image analysis.
- [5]85%Anthropic's Claude 3.5 Haiku model now available in Amazon Bedrockaws.amazon.com· เผยแพร่ 4 พ.ย. 2024· เริ่ม 4 พ.ย. 2024· 2% ของคะแนน
AWS What's New, "Posted on: Nov 4, 2024": Claude[2][3] 3.5 Haiku is now available in Amazon Bedrock and "surpasses even Claude 3 Opus, the largest model in Anthropic's[1][6] previous generation, on many intelligence benchmarks—including coding".
เสนอการแก้ไข
มีอะไรขาดหรือผิดไหม บอกด้วยคำพูดของคุณเอง: ลิงก์ที่สนับสนุนหมุดนี้ วันที่เริ่มหรือสิ้นสุดที่ต่างออกไปพร้อมเหตุผล หรือข้อเท็จจริงที่ขาดหรือผิด AI จะตรวจสอบกับแหล่งที่มาของหมุด ค้นหาแหล่งที่ดีกว่า และเพิ่มหน้าที่สนับสนุนคุณ แหล่งที่มาของหมุดเองยังคงมีน้ำหนักมากที่สุด รูปภาพที่แสดงสิ่งอื่นหรือแสดงได้ไม่ดีก็จะถูกตรวจสอบ และเลื่อนลงหรือแทนที่