- Mulai
- 5 Agu 2025KEYAKINAN 90%dari sumbernya
Claude Opus 4.1 Dirilis
Diterjemahkan otomatis dari aslinya
Judul asli: Claude Opus 4.1 Released
- Anthropic merilis Claude Opus 4.1 pada 5 Agustus 2025 untuk pengguna Claude berbayar, di Claude Code, dan di API-nya, Amazon Bedrock, dan Vertex AI milik Google Cloud, pada harga yang sama dengan Opus 4[1][2]
- Model ini keluar pada hari yang sama ketika OpenAI merilis model penalaran berbobot terbuka pertamanya sejak 2019; Anthropic menyatakan merencanakan “peningkatan yang jauh lebih besar pada model kami dalam beberapa pekan mendatang”[1][6]
- GitHub memasukkannya ke Copilot pada hari yang sama sebagai pratinjau publik untuk paket Enterprise dan Pro+[5]
- Seperti Opus 4, model ini diterapkan di bawah standar keselamatan ASL-3[3]
- Dipensiunkan dari Claude API pada 5 Agustus 2026, tepat setahun setelah peluncuran, digantikan oleh Claude Opus 4.8[4]
Fitur unggulan
- Peningkatan dari Claude Opus 4 “pada tugas agen, pemrograman dunia nyata, dan penalaran”, dengan riset mendalam dan analisis data yang lebih baik, “terutama seputar pelacakan detail dan pencarian agen”[1]
- 74.5% pada SWE-bench Verified dibandingkan 72.5% milik Opus 4, dan 43.3% pada Terminal-Bench dibandingkan 39.2%[1][6]
- Skor lain dalam tabel Anthropic: 80.9% pada GPQA Diamond, 82.4% pada TAU-bench retail, 89.5% pada MMMLU, dan 78.0% pada AIME 2025[1]
- Laporan pelanggan: GitHub melihat peningkatan nyata dalam refaktor multi-file, Rakuten perbaikan presisi pada basis kode besar “tanpa melakukan penyesuaian yang tidak perlu”, dan Windsurf lompatan satu standar deviasi dari Opus 4[1]
- Berharga seperti Opus 4, yaitu $15 per juta token masukan dan $75 per juta token keluaran; ID API claude-opus-4-1-20250805[1][6]
Tolok ukur[1]
| Tolok ukur | Claude Opus 4.1 | Claude Opus 4 | Claude Sonnet 4 | OpenAI o3 | Gemini 2.5 Pro |
|---|---|---|---|---|---|
| SWE-bench Verified¹ (pemrograman agen) | 74.5% | 72.5% | 72.7% | 69.1% | 67.2% |
| Terminal-Bench² (pemrograman terminal agen) | 43.3% | 39.2% | 35.5% | 30.2% | 25.3% |
| GPQA Diamond (penalaran tingkat pascasarjana) | 80.9% | 79.6% | 75.4% | 83.3% | 86.4% |
| TAU-bench (penggunaan alat agen) | Ritel 82.4%, Maskapai 56.0% | Ritel 81.4%, Maskapai 59.6% | Ritel 80.5%, Maskapai 60.0% | Ritel 70.4%, Maskapai 52.0% | — |
| MMMLU³ (tanya jawab multibahasa) | 89.5% | 88.8% | 86.5% | 88.8% | — |
| MMMU, validasi (penalaran visual) | 77.1% | 76.5% | 74.4% | 82.9% | 82% |
| AIME 2025⁴ (kompetisi matematika SMA) | 78.0% | 75.5% | 70.5% | 88.9% | 88% |
¹ Opus 4.1, Opus 4, dan Sonnet 4 dijalankan pass@1 dengan alat bash/editor, dirata-ratakan dari 10 percobaan, patch satu percobaan, tanpa komputasi uji. ² Kerangka agen bawaan (Terminus 1), dirata-ratakan dari 5 percobaan. ³ Skor Claude adalah rata-rata atas 14 bahasa non-Inggris. ⁴ Dijalankan dengan nucleus sampling, top_p 0.95.
Referensi 6KEYAKINAN 89%Keyakinan keseluruhan: 89%Seberapa baik sumber dan referensi pin mendukung tanggalnya.Rata-rata tertimbang dari seberapa kuat 6 referensi, termasuk sumber, mendukung waktu mulai dan berakhir pin; bobot sebuah referensi berkurang setengahnya untuk setiap 180 hari lebih lama dari yang terbaruTampilkan semua pin dengan keyakinan 75% atau lebih tinggi
Entri pertama selalu merupakan sumber pin. Keyakinan keseluruhan adalah rata-rata tertimbang dari seberapa kuat setiap referensi mendukung waktu mulai dan berakhir yang digunakan di atas; bobot sebuah referensi berkurang setengahnya untuk setiap 180 hari lebih lama dari yang terbaru.
- [1]90%anthropic.com/news/claude-opus-4-1anthropic.com· Diposting 28 Sep 2026· Mulai 5 Agu 2025 ✓· 23% dari skor
Unggahan Anthropic[3] bertanggal “5 Agu 2025”: “Hari ini kami merilis Claude[2][4] Opus 4.1 ... kini tersedia untuk pengguna Claude berbayar dan di Claude Code. Model ini juga ada di API kami, Amazon Bedrock, dan Vertex AI milik Google Cloud”; catatan rilis Claude dan changelog GitHub[5] mencantumkan tanggal yang sama.
- [2]90%Claude Platform release notes - Claude Platform Docsplatform.claude.com· Ditambahkan 28 Sep 2026· 23% dari skor
"August 5, 2025 We've launched Claude[4] Opus 4.1, an incremental update to Claude Opus 4", which does not allow both temperature and top_p to be set; later entries record structured outputs launching for Opus 4.1 (14 November 2025) and its retirement.
- [3]90%System Card Addendum: Claude Opus 4.1anthropic.com· Ditambahkan 28 Sep 2026· 23% dari skor
Anthropic's[1] system card addendum: "Like Claude[2][4] Opus 4, Claude Opus 4.1 is deployed under the AI Safety Level 3 (ASL-3) Standard"; it is not "notably more capable" than Opus 4 under the RSP, so new evaluations were voluntary.
- [4]90%Model deprecations - Claude Platform Docsplatform.claude.com· Ditambahkan 28 Sep 2026· 23% dari skor
Anthropic[1][3] notified developers on 5 June 2026 that Claude[2] Opus 4.1 (claude-opus-4-1-20250805) would be retired; it was retired on 5 August 2026, one year after release, with claude-opus-4-8 as the replacement.
- [5]85%Anthropic Claude Opus 4.1 is now in public preview in GitHub Copilotgithub.blog· Diterbitkan 5 Agu 2025· Mulai 5 Agu 2025· 5% dari skor
GitHub's changelog, "Release August 5, 2025": Claude[2][4] Opus 4.1, "the successor to Claude Opus 4", is available in GitHub Copilot Chat for Copilot Enterprise and Pro+ plans on github.com, Visual Studio Code and GitHub Mobile.
Sarankan koreksi
Ada yang kurang atau salah? Sampaikan dengan kata-kata Anda sendiri: tautan yang mendukung pin ini, tanggal mulai atau berakhir yang berbeda beserta alasannya, atau fakta yang kurang atau keliru. AI memeriksanya terhadap sumber pin ini, mencari sumber yang lebih baik, dan menambahkan halaman mana pun yang mendukung Anda. Sumber pin itu sendiri tetap paling diperhitungkan. Gambar yang menampilkan hal lain, atau menampilkannya dengan buruk, juga diperiksa, lalu diturunkan atau diganti.