- 開始
- 2026年6月30日確度 90%出典:出典
Claude Sonnet 5がリリース
原文から自動翻訳されています
元のタイトル: Claude Sonnet 5 Released
- 「Claude Sonnet 5は、これまでで最もエージェント性の高いSonnetモデルとして構築されています」とされ、計画を立て、ブラウザやターミナルなどのツールを使い、自律的に実行しながら、より低い価格でOpus 4.8に近い性能を発揮する。[1][3][4]
- 発売時からFreeおよびProプランのデフォルトとなり、Max、Team、Enterpriseでも利用可能で、Claude APIではclaude-sonnet-5として提供された。Chat、Cowork、Claude Code、Claude Platform全体でレート制限も引き上げられた。[1]
- 発売時の価格は「8月31日まで」入力100万トークンあたり2ドル、出力100万トークンあたり10ドルで、その後3ドル/15ドルに移行する予定だったが、2026年8月10日にAnthropicはこの導入価格を恒久的なものとした。[1][3][4]
- 不整合な振る舞いを示す度合いはSonnet 4.6より少ないが、Opus 4.8やClaude Mythos Previewよりは多い。サイバーセキュリティに関する訓練は一切行われておらず、実際に動くFirefoxのエクスプロイトを構築できなかったが、Opus 4.7や4.8で使われているサイバーセーフガードを搭載している。[1][5]
- Sonnet 4.6のそのまま置き換え可能なアップグレードであり、適応型思考がデフォルトで有効になっており、手動での拡張思考の指定や、temperature、top_p、top_kのデフォルト以外の値の指定は現在エラーとなる。[2]
注目の機能
- 仕様: コンテキストウィンドウ100万トークン、最大出力トークン128,000(ベータ版のBatch APIでは300,000)、デフォルトで高い推論強度の適応型思考、テキストと画像の入力に対しテキストで出力、知識のカットオフは2026年1月。[2]
- Anthropicの表によれば、SWE-bench Proで63.2%、Terminal-Bench 2.1で80.4%、OSWorld-Verifiedで81.2%と、Sonnet 4.6の58.1%、67.0%、78.5%、およびOpus 4.8の69.2%、82.7%、83.4%に対する数値。[1][3]
- 知識労働(GDPval-AA v2)では1618を記録し、Opus 4.8の1615をわずかに上回り、Sonnet 4.6の1395を大きく上回った。[1][3]
- Opus 4.7と同様の新しいトークナイザーを採用し、同じ入力がおおむね1.0倍から1.35倍のトークン数に変換される。[1]
- lowからmaxまでの推論強度でコストと精度を引き換えにできるようになっており、highの強度では一部のタスクでOpus 4.8に匹敵する。[1]
ベンチマーク[1]
| ベンチマーク | Sonnet 5 | Sonnet 4.6 | Opus 4.8 (for reference) |
|---|---|---|---|
| エージェント型コーディング (SWE-bench Pro) | 63.2% | 58.1% | 69.2% |
| エージェント型コーディング (Terminal-Bench 2.1) | 80.4% | 67.0% | 82.7% |
| 複数分野にわたる推論 (Humanity's Last Exam)、ツールなし | 43.2% | 34.6% | 49.8% |
| 複数分野にわたる推論 (Humanity's Last Exam)、ツールあり | 57.4% | 46.8% | 57.9% |
| コンピュータ操作 (OSWorld-Verified) | 81.2% | 78.5% | 83.4% |
| 知識労働 (GDPval-AA v2) | 1618 | 1395 | 1615 |
参考資料 5確度 88%総合信頼度: 88%ピンの情報源と参照がその日付をどれだけ裏付けているか。出典を含む 5 件の資料がピンの開始・終了時刻をどれだけ強く裏付けているかの加重平均。最新の資料より180日古くなるごとに重みは半分になります確度75%以上のピンをすべて表示
最初の項目は常にピンの出典です。全体の確度は、各資料が上記の開始・終了時刻をどれだけ強く裏付けているかの加重平均です。最新の資料より180日古くなるごとに、重みは半分になります。
- [1]90%anthropic.com/news/claude-sonnet-5anthropic.com· 投稿 2026年9月28日· 開始 2026年6月30日 ✓· スコアの 24%
この投稿には日付が「Jun 30, 2026」と記載され、「本日より、Claude[2] Sonnet 5は全プランで利用可能です」とある。ドキュメントのモデルページには「Released June 30, 2026」と記載され、TechCrunch[3]の2026年6月30日付の記事も「火曜日より」デフォルトになったと報じている。
- [2]90%Claude Sonnet 5 - Claude Platform Docsplatform.claude.com· 追加 2026年9月28日· スコアの 24%
Anthropic's[1][5] model page: claude-sonnet-5, a drop-in upgrade for Sonnet 4.6 with adaptive thinking on by default, 1M-token context, 128K max output (300K Batch beta), $2/$10 per million tokens, text and images in, a January 2026 knowledge cutoff, "Released June 30, 2026".
- [3]88%Anthropic launches Claude Sonnet 5 as a cheaper way to run agentstechcrunch.com· 公開 2026年6月30日· 開始 2026年6月30日· スコアの 17%
TechCrunch, 2026-06-30: default for Free and Pro "Starting Tuesday"; $2/$10 per million tokens through August 31, then $3/$15, cheaper than Opus 4.8, GPT-5.5 and Gemini 3.1 Pro but dearer than Gemini 3.5 Flash; 63.2% on agentic coding against Opus 4.8's 69.2% and Sonnet 4.6's 58.1%.
- [4]80%Anthropic Launches Claude Sonnet 5 With Near-Opus Performance at a Lower Pricemacrumors.com· 公開 2026年6月30日· 開始 2026年6月30日· スコアの 17%
MacRumors, 2026-06-30: "Anthropic[1][5] today introduced Claude[2] Sonnet 5", its most agentic Sonnet, with performance similar to Opus 4.8, lower hallucination and sycophancy, and the launch pricing of $2/$10 before a planned rise to $3/$15.
- [5]90%System Card: Claude Sonnet 5anthropic.com· 公開 2026年6月30日· スコアの 17%
Anthropic's[1] system card dated "June 30, 2026", describing "the latest model in Anthropic's Sonnet family" as an upgrade to Claude[2] Sonnet 4.6, with the behavioural audit and Firefox exploit results the launch post cites.
修正を提案
足りない点や誤りがありますか? このピンを裏付けるリンク、別の開始日・終了日とその理由、欠けている情報や誤っている情報を、自由に書いてください。AIがこのピンの出典と照らし合わせ、より良い情報源を探し、裏付けとなるページがあれば参考資料として追加します。ピン自身の出典が引き続き最も重視されます。AIは画像も確認します。別のものが写っている画像や写りの悪い画像は、後ろに回すか差し替えます。