- Mulai
- 4 Nov 2024KEYAKINAN 92%dari platform.claude.com
Claude 3.5 Haiku Dirilis
Diterjemahkan otomatis dari aslinya
Judul asli: Claude 3.5 Haiku Released
- Anthropic mengumumkan Claude 3.5 Haiku pada 22 Oktober 2024 bersama Claude 3.5 Sonnet yang ditingkatkan dan penggunaan komputer, dan merilisnya pada 4 November di Claude API, Amazon Bedrock, dan Vertex AI milik Google Cloud[2][5][6]
- Model ini diluncurkan seharga $1 per juta token masukan dan $5 per juta token keluaran, empat kali harga Claude 3 Haiku, setelah Anthropic menyatakan bahwa dalam pengujian akhir model ini telah “melampaui Claude 3 Opus, andalan kami sebelumnya, pada banyak tolok ukur”[4]
- Model ini dirilis hanya teks; Claude 3 Haiku tetap tersedia bagi pengguna yang membutuhkan “efisiensi biaya maksimum dan pemrosesan gambar”, dan dukungan visual datang pada 24 Februari 2025[2][4]
- Anthropic memangkas harganya menjadi $0.80 dan $4 per juta token dalam pembaruan bertanggal 3 Desember 2024[6]
- Dinyatakan usang pada 19 Desember 2025 dan dipensiunkan dari Claude API pada 19 Februari 2026, digantikan oleh Claude Haiku 4.5[3]
Fitur unggulan
- Generasi berikutnya dari model tercepat Anthropic: dengan kecepatan yang mirip Claude 3 Haiku model ini “meningkat di setiap rangkaian keterampilan” dan dalam banyak kasus menyamai Claude 3.5 Sonnet asli dan Claude 3 Opus[1][6]
- Pemrograman: 40.6% pada SWE-bench Verified, di atas 33.4% milik Claude 3.5 Sonnet asli dan 22.2% milik Claude 3 Opus, dan 74% pada uji pemrograman agen internal Anthropic dibandingkan 38% milik Opus[1][6]
- Skor lain yang dilaporkan: 88.1% pada HumanEval, 41.6% pada GPQA Diamond, 65.0% pada MMLU Pro, dan 51.0% pada TAU-bench retail dibandingkan 75.9%, 33.3%, 49.0%, dan 18.2% milik Claude 3 Haiku[1]
- Batas pengetahuan Juli 2024, lebih baru daripada Claude 3 Haiku, dan keluaran yang lebih panjang; ditujukan untuk produk yang berhadapan dengan pengguna, tugas sub-agen, dan personalisasi dari kumpulan data besar[1][4][6]
Tolok ukur[6]
| Tolok ukur | Claude 3.5 Sonnet (new) | Claude 3.5 Haiku | Claude 3.5 Sonnet | GPT-4o* | GPT-4o mini* | Gemini 1.5 Pro | Gemini 1.5 Flash |
|---|---|---|---|---|---|---|---|
| GPQA (Diamond) (penalaran tingkat pascasarjana) | 65.0% 0-shot CoT | 41.6% 0-shot CoT | 59.4% 0-shot CoT | 53.6% 0-shot CoT | 40.2% 0-shot CoT | 59.1% 0-shot CoT | 51.0% 0-shot CoT |
| MMLU Pro (pengetahuan tingkat sarjana) | 78.0% 0-shot CoT | 65.0% 0-shot CoT | 75.1% 0-shot CoT | — | — | 75.8% 0-shot CoT | 67.3% 0-shot CoT |
| HumanEval (kode) | 93.7% 0-shot | 88.1% 0-shot | 92.0% 0-shot | 90.2% 0-shot | 87.2% 0-shot | — | — |
| MATH (pemecahan soal matematika) | 78.3% 0-shot CoT | 69.2% 0-shot CoT | 71.1% 0-shot CoT | 76.6% 0-shot CoT | 70.2% 0-shot CoT | 86.5% 4-shot CoT | 77.9% 4-shot CoT |
| AIME 2024 (kompetisi matematika SMA) | 16.0% 0-shot CoT | 5.3% 0-shot CoT | 9.6% 0-shot CoT | 9.3% 0-shot CoT | — | — | — |
| MMMU (tanya jawab visual) | 70.4% 0-shot CoT | — | 68.3% 0-shot CoT | 69.1% 0-shot CoT | 59.4% 0-shot CoT | 65.9% 0-shot CoT | 62.3% 0-shot CoT |
| SWE-bench Verified (pemrograman agen) | 49.0% | 40.6% | 33.4% | — | — | — | — |
| TAU-bench (penggunaan alat agen) | Ritel 69.2%, Maskapai 46.0% | Ritel 51.0%, Maskapai 22.8% | Ritel 62.6%, Maskapai 36.0% | — | — | — | — |
* Tabel evaluasi Anthropic tidak menyertakan keluarga model o1 milik OpenAI, yang bergantung pada waktu komputasi pra-respons yang ekstensif dan menyulitkan perbandingan.
Referensi 6KEYAKINAN 90%Keyakinan keseluruhan: 90%Seberapa baik sumber dan referensi pin mendukung tanggalnya.Rata-rata tertimbang dari seberapa kuat 6 referensi, termasuk sumber, mendukung waktu mulai dan berakhir pin; bobot sebuah referensi berkurang setengahnya untuk setiap 180 hari lebih lama dari yang terbaruTampilkan semua pin dengan keyakinan 75% atau lebih tinggi
Entri pertama selalu merupakan sumber pin. Keyakinan keseluruhan adalah rata-rata tertimbang dari seberapa kuat setiap referensi mendukung waktu mulai dan berakhir yang digunakan di atas; bobot sebuah referensi berkurang setengahnya untuk setiap 180 hari lebih lama dari yang terbaru.
- [1]90%assets.anthropic.com/m/1cd9d098ac3e6467/original/Claude-3-Model-Card-October-Addendum.pdfassets.anthropic.com· Diposting 28 Sep 2026· Mulai 4 Nov 2024· 31% dari skor
Catatan rilis Claude[2][3]: “4 November 2024 Claude Haiku 3.5 kini tersedia di Claude API sebagai model khusus teks”; TechCrunch[4] (10.24 PST, 4 November 2024) melaporkan “Model AI terbaru Anthropic[6] telah tiba” dan AWS mengumumkan ketersediaan Bedrock pada hari yang sama. Unggahan 22 Oktober telah menyatakan model ini “akan dirilis akhir bulan ini”.
- [2]92%Claude Platform release notes - Claude Platform Docsplatform.claude.com· Ditambahkan 28 Sep 2026· Mulai 4 Nov 2024 ✓· 31% dari skor
Anthropic's[1][6] own dated changelog: "November 4th, 2024 Claude[3] Haiku 3.5 is now available on the Claude API as a text-only model", and on 24 February 2025 "We've added vision support to Claude Haiku 3.5". The model card addendum that is the source carries no release date, so this entry dates the pin.
- [3]90%Model deprecations - Claude Platform Docsplatform.claude.com· Ditambahkan 28 Sep 2026· 31% dari skor
Anthropic[1][6] notified developers on 19 December 2025 that Claude[2] Haiku 3.5 (claude-3-5-haiku-20241022) would be retired; it was retired on 19 February 2026, with claude-haiku-4-5-20251001 as the replacement.
- [4]88%Anthropic hikes the price of its Haiku modeltechcrunch.com· Diterbitkan 4 Nov 2024· Mulai 4 Nov 2024· 2% dari skor
TechCrunch (Kyle Wiggers, 10:24 AM PST, 4 November 2024): "Anthropic's[1][6] newest AI model has arrived"; it costs $1 per million input and $5 per million output tokens against Claude[2][3] 3 Haiku's $0.25 and $1.25, "a 4x hike", quoting Anthropic that "we've increased pricing for Claude 3.5 Haiku to reflect its increase in intelligence", and it launches without image analysis.
- [5]85%Anthropic's Claude 3.5 Haiku model now available in Amazon Bedrockaws.amazon.com· Diterbitkan 4 Nov 2024· Mulai 4 Nov 2024· 2% dari skor
AWS What's New, "Posted on: Nov 4, 2024": Claude[2][3] 3.5 Haiku is now available in Amazon Bedrock and "surpasses even Claude 3 Opus, the largest model in Anthropic's[1][6] previous generation, on many intelligence benchmarks—including coding".
Sarankan koreksi
Ada yang kurang atau salah? Sampaikan dengan kata-kata Anda sendiri: tautan yang mendukung pin ini, tanggal mulai atau berakhir yang berbeda beserta alasannya, atau fakta yang kurang atau keliru. AI memeriksanya terhadap sumber pin ini, mencari sumber yang lebih baik, dan menambahkan halaman mana pun yang mendukung Anda. Sumber pin itu sendiri tetap paling diperhitungkan. Gambar yang menampilkan hal lain, atau menampilkannya dengan buruk, juga diperiksa, lalu diturunkan atau diganti.