- Mula
- 4 Nov 202492% KEYAKINANdaripada platform.claude.com
Claude 3.5 Haiku Dilancarkan
Diterjemah secara automatik daripada asal
Tajuk asal: Claude 3.5 Haiku Released
- Anthropic mengumumkan Claude 3.5 Haiku pada 22 Oktober 2024 bersama Claude 3.5 Sonnet yang dinaik taraf dan penggunaan komputer, dan melancarkannya pada 4 November dalam API Claude, Amazon Bedrock dan Vertex AI milik Google Cloud[2][5][6]
- Ia dilancarkan pada harga $1 setiap juta token input dan $5 setiap juta token output, empat kali ganda harga Claude 3 Haiku, selepas Anthropic berkata dalam ujian akhir bahawa ia telah "surpassed Claude 3 Opus, our previous flagship model, on many benchmarks" (mengatasi Claude 3 Opus, model utama kami sebelum ini, pada banyak penanda aras)[4]
- Ia dihantar sebagai teks sahaja; Claude 3 Haiku kekal tersedia untuk pengguna yang memerlukan "maximum cost-efficiency and image processing" (kecekapan kos maksimum dan pemprosesan imej), dan sokongan penglihatan menyusul pada 24 Februari 2025[2][4]
- Anthropic menurunkan harga kepada $0.80 dan $4 setiap juta token dalam kemas kini bertarikh 3 Disember 2024[6]
- Dihentikan penggunaannya (deprecated) pada 19 Disember 2025 dan ditamatkan daripada API Claude pada 19 Februari 2026, digantikan dengan Claude Haiku 4.5[3]
Ciri-ciri menonjol
- Generasi seterusnya model Anthropic yang paling pantas: pada kelajuan yang serupa dengan Claude 3 Haiku ia "improves across every skill set" (bertambah baik merentas setiap set kemahiran) dan dalam banyak kes menyamai Claude 3.5 Sonnet yang asal serta Claude 3 Opus[1][6]
- Pengekodan: 40.6% pada SWE-bench Verified, melebihi 33.4% bagi Claude 3.5 Sonnet yang asal dan 22.2% bagi Claude 3 Opus, serta 74% pada ujian pengekodan agentik dalaman Anthropic berbanding 38% bagi Opus[1][6]
- Skor lain yang dilaporkan: 88.1% pada HumanEval, 41.6% pada GPQA Diamond, 65.0% pada MMLU Pro dan 51.0% pada runcit TAU-bench berbanding 75.9%, 33.3%, 49.0% dan 18.2% bagi Claude 3 Haiku[1]
- Had pengetahuan Julai 2024, lebih terkini daripada Claude 3 Haiku, dan output yang lebih panjang; disasarkan untuk produk yang berhadapan pengguna, tugas sub-ejen dan pemperibadian daripada set data besar[1][4][6]
Penanda aras[6]
| Penanda aras | Claude 3.5 Sonnet (new) | Claude 3.5 Haiku | Claude 3.5 Sonnet | GPT-4o* | GPT-4o mini* | Gemini 1.5 Pro | Gemini 1.5 Flash |
|---|---|---|---|---|---|---|---|
| GPQA (Diamond) (penaakulan peringkat pascasiswazah) | 65.0% 0-shot CoT | 41.6% 0-shot CoT | 59.4% 0-shot CoT | 53.6% 0-shot CoT | 40.2% 0-shot CoT | 59.1% 0-shot CoT | 51.0% 0-shot CoT |
| MMLU Pro (pengetahuan peringkat sarjana muda) | 78.0% 0-shot CoT | 65.0% 0-shot CoT | 75.1% 0-shot CoT | — | — | 75.8% 0-shot CoT | 67.3% 0-shot CoT |
| HumanEval (kod) | 93.7% 0-shot | 88.1% 0-shot | 92.0% 0-shot | 90.2% 0-shot | 87.2% 0-shot | — | — |
| MATH (penyelesaian masalah matematik) | 78.3% 0-shot CoT | 69.2% 0-shot CoT | 71.1% 0-shot CoT | 76.6% 0-shot CoT | 70.2% 0-shot CoT | 86.5% 4-shot CoT | 77.9% 4-shot CoT |
| AIME 2024 (pertandingan matematik sekolah menengah) | 16.0% 0-shot CoT | 5.3% 0-shot CoT | 9.6% 0-shot CoT | 9.3% 0-shot CoT | — | — | — |
| MMMU (soal jawab visual) | 70.4% 0-shot CoT | — | 68.3% 0-shot CoT | 69.1% 0-shot CoT | 59.4% 0-shot CoT | 65.9% 0-shot CoT | 62.3% 0-shot CoT |
| SWE-bench Verified (pengekodan secara ejen) | 49.0% | 40.6% | 33.4% | — | — | — | — |
| TAU-bench (penggunaan alat secara ejen) | Runcit 69.2%, Penerbangan 46.0% | Runcit 51.0%, Penerbangan 22.8% | Runcit 62.6%, Penerbangan 36.0% | — | — | — | — |
* Jadual penilaian Anthropic tidak merangkumi keluarga model o1 milik OpenAI, yang bergantung pada masa pengiraan yang panjang sebelum memberi jawapan dan menyukarkan perbandingan.
Rujukan 690% KEYAKINANKeyakinan keseluruhan: 90%Sejauh mana sumber dan rujukan pin menyokong tarikhnya.Purata berpemberat bagi sejauh mana 6 rujukan, termasuk sumber, menyokong masa mula dan tamat pin; sesebuah rujukan diambil kira separuh kurang bagi setiap 180 hari lebih lama daripada yang terbaharuTunjuk semua pin pada keyakinan 75% atau lebih baik
Entri pertama sentiasa sumber pin. Keyakinan keseluruhan ialah purata berpemberat bagi sejauh mana setiap rujukan menyokong masa mula dan tamat yang digunakan di atas; sesebuah rujukan diambil kira separuh kurang bagi setiap 180 hari lebih lama daripada yang terbaharu.
- [1]90%assets.anthropic.com/m/1cd9d098ac3e6467/original/Claude-3-Model-Card-October-Addendum.pdfassets.anthropic.com· Disiarkan 28 Sep 2026· Bermula 4 Nov 2024· 31% daripada skor
Nota keluaran Claude[2][3]: "November 4th, 2024 Claude Haiku 3.5 is now available on the Claude API as a text-only model"; TechCrunch[4] (10:24 AM PST, 4 November 2024) melaporkan "Anthropic's[6] newest AI model has arrived" dan AWS menyiarkan ketersediaan Bedrock pada hari yang sama. Siaran 22 Oktober telah menyatakan ia "will be released later this month".
- [2]92%Claude Platform release notes - Claude Platform Docsplatform.claude.com· Ditambah 28 Sep 2026· Bermula 4 Nov 2024 ✓· 31% daripada skor
Anthropic's[1][6] own dated changelog: "November 4th, 2024 Claude[3] Haiku 3.5 is now available on the Claude API as a text-only model", and on 24 February 2025 "We've added vision support to Claude Haiku 3.5". The model card addendum that is the source carries no release date, so this entry dates the pin.
- [3]90%Model deprecations - Claude Platform Docsplatform.claude.com· Ditambah 28 Sep 2026· 31% daripada skor
Anthropic[1][6] notified developers on 19 December 2025 that Claude[2] Haiku 3.5 (claude-3-5-haiku-20241022) would be retired; it was retired on 19 February 2026, with claude-haiku-4-5-20251001 as the replacement.
- [4]88%Anthropic hikes the price of its Haiku modeltechcrunch.com· Diterbitkan 4 Nov 2024· Bermula 4 Nov 2024· 2% daripada skor
TechCrunch (Kyle Wiggers, 10:24 AM PST, 4 November 2024): "Anthropic's[1][6] newest AI model has arrived"; it costs $1 per million input and $5 per million output tokens against Claude[2][3] 3 Haiku's $0.25 and $1.25, "a 4x hike", quoting Anthropic that "we've increased pricing for Claude 3.5 Haiku to reflect its increase in intelligence", and it launches without image analysis.
- [5]85%Anthropic's Claude 3.5 Haiku model now available in Amazon Bedrockaws.amazon.com· Diterbitkan 4 Nov 2024· Bermula 4 Nov 2024· 2% daripada skor
AWS What's New, "Posted on: Nov 4, 2024": Claude[2][3] 3.5 Haiku is now available in Amazon Bedrock and "surpasses even Claude 3 Opus, the largest model in Anthropic's[1][6] previous generation, on many intelligence benchmarks—including coding".
Cadangkan pembetulan
Ada yang tertinggal atau salah? Nyatakan dengan kata-kata anda sendiri: pautan yang menyokong pin ini, tarikh mula atau tamat yang berbeza beserta sebabnya, atau fakta yang tiada atau tersilap. AI menyemaknya berbanding sumber pin ini, mencari yang lebih baik, dan menambah mana-mana halaman yang menyokong anda. Sumber pin itu sendiri tetap paling diambil kira. Gambar yang menunjukkan sesuatu yang lain, atau menunjukkannya dengan buruk, turut dilihat, dan dialihkan ke bawah atau diganti.