- Mulai
- 4 Mar 2024KEYAKINAN 95%dari anthropic.com
Claude 3 Sonnet Dirilis
Diterjemahkan otomatis dari aslinya
Judul asli: Claude 3 Sonnet Released
- Anthropic mengumumkan keluarga Claude 3 - Haiku, Sonnet, dan Opus - pada 4 Maret 2024, dengan Opus dan Sonnet “kini tersedia untuk dipakai di claude.ai dan Claude API”, yang menjadi tersedia secara umum di 159 negara; Haiku akan menyusul[3]
- Sonnet menopang “pengalaman gratis di claude.ai”, dengan Opus dicadangkan bagi pelanggan Claude Pro, dan diluncurkan pada hari yang sama di Amazon Bedrock dan dalam pratinjau privat di Vertex AI Model Garden milik Google Cloud[3][4]
- Anthropic memosisikannya sebagai model yang “mencapai keseimbangan ideal antara kecerdasan dan kecepatan—terutama untuk beban kerja perusahaan”, dan untuk sebagian besar beban kerja dua kali lebih cepat daripada Claude 2 dan Claude 2.1[3][4]
- Keluarga ini tetap berada pada AI Safety Level 2 (ASL-2) di bawah Responsible Scaling Policy Anthropic, dan jauh lebih jarang menolak prompt yang tidak berbahaya di dekat batas pengamannya dibandingkan model Claude sebelumnya[3]
- Ketika Anthropic memensiunkan Claude 3 Sonnet pada Juli 2025, sekitar 200 orang berkumpul di San Francisco untuk sebuah “pemakaman”[2]
Fitur unggulan
- Berharga $3 per juta token masukan dan $15 per juta token keluaran, dengan jendela konteks 200K token[3]
- Generasi Claude pertama dengan kemampuan visual: membaca foto, bagan, grafik, dan diagram teknis, hingga 20 gambar dalam satu permintaan, meski Anthropic menghentikannya mengidentifikasi orang[1][5]
- Tolok ukur kartu model: 79.0% pada MMLU (5-shot), 40.4% pada GPQA Diamond, 92.3% pada GSM8K, dan 73.0% pada pemrograman Python HumanEval[1]
- Dilatih pada perangkat keras Amazon Web Services dan Google Cloud dengan PyTorch, JAX, dan Triton; model ini menjawab dari data sebelum Agustus 2023 dan tidak dapat mencari di web[1][5]
- Penggunaan yang disarankan Anthropic: pencarian atas basis pengetahuan besar, rekomendasi produk dan prakiraan, pembuatan kode, dan penguraian teks dari gambar[3]
Tolok ukur[3]
| Tolok ukur | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| Pengetahuan tingkat sarjana (MMLU) | 86.8% (5-shot) | 79.0% (5-shot) | 75.2% (5-shot) | 86.4% (5-shot) | 70.0% (5-shot) | 83.7% (5-shot) | 71.8% (5-shot) |
| Penalaran tingkat pascasarjana (GPQA, Diamond) | 50.4% (0-shot CoT) | 40.4% (0-shot CoT) | 33.3% (0-shot CoT) | 35.7% (0-shot CoT) | 28.1% (0-shot CoT) | — | — |
| Matematika sekolah dasar (GSM8K) | 95.0% (0-shot CoT) | 92.3% (0-shot CoT) | 88.9% (0-shot CoT) | 92.0% (5-shot CoT) | 57.1% (5-shot) | 94.4% (Maj1@32) | 86.5% (Maj1@32) |
| Pemecahan soal matematika (MATH) | 60.1% (0-shot CoT) | 43.1% (0-shot CoT) | 38.9% (0-shot CoT) | 52.9% (4-shot) | 34.1% (4-shot) | 53.2% (4-shot) | 32.6% (4-shot) |
| Matematika multibahasa (MGSM) | 90.7% (0-shot) | 83.5% (0-shot) | 75.1% (0-shot) | 74.5% (8-shot) | — | 79.0% (8-shot) | 63.5% (8-shot) |
| Kode (HumanEval) | 84.9% (0-shot) | 73.0% (0-shot) | 75.9% (0-shot) | 67.0% (0-shot) | 48.1% (0-shot) | 74.4% (0-shot) | 67.7% (0-shot) |
| Penalaran atas teks (DROP, skor F1) | 83.1 (3-shot) | 78.9 (3-shot) | 78.4 (3-shot) | 80.9 (3-shot) | 64.1 (3-shot) | 82.4 (shot bervariasi) | 74.1 (shot bervariasi) |
| Evaluasi campuran (BIG-Bench-Hard) | 86.8% (3-shot CoT) | 82.9% (3-shot CoT) | 73.7% (3-shot CoT) | 83.1% (3-shot CoT) | 66.6% (3-shot CoT) | 83.6% (3-shot CoT) | 75.0% (3-shot CoT) |
| Tanya jawab pengetahuan (ARC-Challenge) | 96.4% (25-shot) | 93.2% (25-shot) | 89.2% (25-shot) | 96.3% (25-shot) | 85.2% (25-shot) | — | — |
| Pengetahuan umum (HellaSwag) | 95.4% (10-shot) | 89.0% (10-shot) | 85.9% (10-shot) | 95.3% (10-shot) | 85.5% (10-shot) | 87.8% (10-shot) | 84.7% (10-shot) |
Referensi 5KEYAKINAN 83%Keyakinan keseluruhan: 83%Seberapa baik sumber dan referensi pin mendukung tanggalnya.Rata-rata tertimbang dari seberapa kuat 5 referensi, termasuk sumber, mendukung waktu mulai dan berakhir pin; bobot sebuah referensi berkurang setengahnya untuk setiap 180 hari lebih lama dari yang terbaruTampilkan semua pin dengan keyakinan 75% atau lebih tinggi
Entri pertama selalu merupakan sumber pin. Keyakinan keseluruhan adalah rata-rata tertimbang dari seberapa kuat setiap referensi mendukung waktu mulai dan berakhir yang digunakan di atas; bobot sebuah referensi berkurang setengahnya untuk setiap 180 hari lebih lama dari yang terbaru.
- [1]90%anthropic.com/claude-3-model-cardanthropic.com· Diposting 28 Sep 2026· Mulai 4 Mar 2024· 48% dari skor
Kartu model tidak mencantumkan tanggal peluncuran, sehingga tanggalnya adalah milik unggahan peluncuran: “Memperkenalkan generasi Claude berikutnya, 4 Mar 2024” - “Opus dan Sonnet kini tersedia untuk dipakai di claude.ai dan Claude API”; unggahan AWS tanggal 04 MAR 2024 mengumumkan “ketersediaan Claude 3 Sonnet dari Anthropic[3] hari ini di Amazon[4] Bedrock”.
- [2]75%Claude (AI) - Wikipediaen.wikipedia.org· Ditambahkan 28 Sep 2026· 48% dari skor
The Sonnet table lists Claude 3 Sonnet as released 4 March 2024 and discontinued; the article adds that when Anthropic[1][3] retired it in July 2025 around 200 people gathered in San Francisco for a "funeral".
- [3]95%Introducing the next generation of Claudeanthropic.com· Diterbitkan 4 Mar 2024· Mulai 4 Mar 2024 ✓· 1% dari skor
Anthropic's[1] launch post, dated "Mar 4, 2024": "Opus and Sonnet are now available to use in claude.ai and the Claude API which is now generally available in 159 countries", with Sonnet at $3/$15 per million tokens and a 200K context window, powering the free claude.ai. The model card that is the source carries no launch date, so this row dates the pin.
- [4]90%Anthropic's Claude 3 Sonnet foundation model is now available in Amazon Bedrockaws.amazon.com· Diterbitkan 4 Mar 2024· Mulai 4 Mar 2024· 1% dari skor
AWS News Blog post by Channy Yun, 04 MAR 2024: "We're also announcing the availability of Anthropic's[1][3] Claude 3 Sonnet today in Amazon Bedrock, with Claude 3 Opus and Claude 3 Haiku coming soon"; Sonnet is two times faster than Claude 2 and 2.1.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· Diterbitkan 4 Mar 2024· Mulai 4 Mar 2024· 1% dari skor
TechCrunch's same-day report: Opus and Sonnet "are available now on the web and via Anthropic's[1][3] dev console and API, Amazon's[4] Bedrock platform and Google's Vertex AI"; Claude 3 is Anthropic's first multimodal model, takes up to 20 images per request, cannot identify people and answers only from data before August 2023.
Sarankan koreksi
Ada yang kurang atau salah? Sampaikan dengan kata-kata Anda sendiri: tautan yang mendukung pin ini, tanggal mulai atau berakhir yang berbeda beserta alasannya, atau fakta yang kurang atau keliru. AI memeriksanya terhadap sumber pin ini, mencari sumber yang lebih baik, dan menambahkan halaman mana pun yang mendukung Anda. Sumber pin itu sendiri tetap paling diperhitungkan. Gambar yang menampilkan hal lain, atau menampilkannya dengan buruk, juga diperiksa, lalu diturunkan atau diganti.