- 開始
- 2024年3月4日確度 90%出典:出典
Claude 3 Opusがリリース
原文から自動翻訳されています
元のタイトル: Claude 3 Opus Released
- Anthropicは2024年3月4日、Haiku・Sonnet・Opusの3モデルからなるClaude 3ファミリーを「能力の低い順に」発表し、OpusとSonnetは同日中にclaude.aiとClaude APIで利用可能になった。現在は159か国で一般提供されている。[1][4]
- claude.aiではOpusがClaude Pro契約者向けに、Sonnetが無料版の中核として提供された。Sonnetはその日のうちにAmazon Bedrockと、Google Cloud Vertex AIのプライベートプレビューにも到達し、「OpusとHaikuも近日中に両方へ提供される」とされた。[1]
- Anthropicはレッドチーミングの結果「現時点では破滅的リスクの可能性はごくわずか」と判断し、本モデルをAIセーフティレベル2(ASL-2)のまま維持した。[1]
- CNBCは、Anthropicの出資者にGoogle、Salesforce、Amazonが含まれており、その前年に総額約73億ドルの資金調達契約があったことを指摘している。[4]
- Claude 3 Opusは2025年6月30日に非推奨となり、2026年1月5日にClaude APIから提供終了となって、Claude Opus 4.8に置き換えられた。[3]
注目の機能
- Claude 3 Opusは「当社で最も知能が高く、非常に複雑なタスクにおいて市場最高水準の性能を持つモデル」であり、価格は入力100万トークンあたり15ドル、出力100万トークンあたり75ドル。[1][5]
- Anthropicが報告したベンチマーク: MMLUで86.8%、GPQA Diamondで50.4%、GSM8Kで95.0%、HumanEvalで84.9%と、GPT-4の86.4%、35.7%、92.0%、67.0%を上回った。[1]
- 発売時のコンテキストウィンドウは200Kトークンで、「特定の用途向けに」100万トークンを超える入力も利用可能。Needle In A Haystack(埋め込み文抽出)テストでは99%の精度を達成し、埋め込まれた文が人為的に挿入されたものだと気づくこともあった。[1][5]
- Claude初のビジョンモデルであり、写真、チャート、グラフ、技術図を読み取ることができ、1回のリクエストで最大20枚の画像を処理できるが、人物の識別は行わない。[1][5]
- Opusは以前のClaudeモデルに比べて無害なプロンプトを拒否する可能性が「著しく低く」、難解でオープンエンドな事実質問への正答率はClaude 2.1の2倍。知識は2023年8月までのものである。[1][2]
ベンチマーク[1]
| ベンチマーク | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| MMLU (大学レベルの知識) | 86.8% 5 shot | 79.0% 5ショット | 75.2% 5ショット | 86.4% 5ショット | 70.0% 5ショット | 83.7% 5ショット | 71.8% 5ショット |
| GPQA, Diamond (大学院レベルの推論) | 50.4% 0ショットCoT | 40.4% 0ショットCoT | 33.3% 0ショットCoT | 35.7% 0ショットCoT | 28.1% 0ショットCoT | — | — |
| GSM8K (小学校レベルの数学) | 95.0% 0ショットCoT | 92.3% 0ショットCoT | 88.9% 0ショットCoT | 92.0% 5ショットCoT | 57.1% 5ショット | 94.4% Maj1@32 | 86.5% Maj1@32 |
| MATH (数学の問題解決) | 60.1% 0ショットCoT | 43.1% 0ショットCoT | 38.9% 0ショットCoT | 52.9% 4ショット | 34.1% 4ショット | 53.2% 4ショット | 32.6% 4ショット |
| MGSM (多言語の数学) | 90.7% 0ショット | 83.5% 0ショット | 75.1% 0ショット | 74.5% 8ショット | — | 79.0% 8ショット | 63.5% 8ショット |
| HumanEval (コード) | 84.9% 0ショット | 73.0% 0ショット | 75.9% 0ショット | 67.0% 0ショット | 48.1% 0ショット | 74.4% 0ショット | 67.7% 0ショット |
| DROP, F1 score (テキストに基づく推論) | 83.1 3ショット | 78.9 3ショット | 78.4 3ショット | 80.9 3ショット | 64.1 3ショット | 82.4 可変ショット数 | 74.1 可変ショット数 |
| BIG-Bench-Hard (複合評価) | 86.8% 3ショットCoT | 82.9% 3ショットCoT | 73.7% 3ショットCoT | 83.1% 3ショットCoT | 66.6% 3ショットCoT | 83.6% 3ショットCoT | 75.0% 3ショットCoT |
| ARC-Challenge (知識問答) | 96.4% 25ショット | 93.2% 25ショット | 89.2% 25ショット | 96.3% 25ショット | 85.2% 25ショット | — | — |
| HellaSwag (一般常識) | 95.4% 10ショット | 89.0% 10ショット | 85.9% 10ショット | 95.3% 10ショット | 85.5% 10ショット | 87.8% 10ショット | 84.7% 10ショット |
参考資料 5確度 90%総合信頼度: 90%ピンの情報源と参照がその日付をどれだけ裏付けているか。出典を含む 5 件の資料がピンの開始・終了時刻をどれだけ強く裏付けているかの加重平均。最新の資料より180日古くなるごとに重みは半分になります確度75%以上のピンをすべて表示
最初の項目は常にピンの出典です。全体の確度は、各資料が上記の開始・終了時刻をどれだけ強く裏付けているかの加重平均です。最新の資料より180日古くなるごとに、重みは半分になります。
- [1]90%anthropic.com/news/claude-3-familyanthropic.com· 投稿 2026年9月28日· 開始 2024年3月4日 ✓· スコアの 33%
Anthropic[2]の投稿には日付が「Mar 4, 2024」と記載され、「OpusとSonnetはclaude[3].aiとClaude APIで現在利用可能となっており、Claude APIは現在159か国で一般提供されている」とある。CNBC[4]とTechCrunch[5]も同じ月曜日にこのリリースを報じている。
- [2]90%The Claude 3 Model Family: Opus, Sonnet, Haiku (model card)anthropic.com· 追加 2026年9月28日· スコアの 33%
Anthropic's[1] Claude[3] 3 model card (the link resolves to the PDF): the Claude 3 models' knowledge cutoff is August 2023 and they are offered through the Claude API, Amazon Bedrock and Google Vertex AI; it carries the full evaluations behind the launch post's table.
- [3]90%Model deprecations - Claude Platform Docsplatform.claude.com· 追加 2026年9月28日· スコアの 33%
Anthropic's[1][2] deprecation history: on 30 June 2025 it notified developers of Claude Opus 3's retirement, and claude-3-opus-20240229 was retired on 5 January 2026 with claude-opus-4-8 as the recommended replacement.
- [4]85%Anthropic, backed by Amazon and Google, debuts its most powerful chatbot yetcnbc.com· 公開 2024年3月4日· 開始 2024年3月4日· スコアの 1%
CNBC's same-day report (published 2024-03-04T14:00Z): "Anthropic[1][2] on Monday debuted Claude[3] 3"; Opus outperformed GPT-4 and Gemini Ultra on benchmark tests, it is Anthropic's first multimodal model, Opus and Sonnet are available in 159 countries, and Anthropic's backers include Google, Salesforce and Amazon after about $7.3 billion in funding deals over the past year.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· 公開 2024年3月4日· 開始 2024年3月4日· スコアの 1%
TechCrunch (Kyle Wiggers, 11:50 AM PST, 4 March 2024): Claude[3] 3 is Anthropic's[1][2] first multimodal model, can analyze up to 20 images in one request, starts with a 200,000-token context window (1 million for select customers), answers from data before August 2023, and Opus costs $15 per million input and $75 per million output tokens.
修正を提案
足りない点や誤りがありますか? このピンを裏付けるリンク、別の開始日・終了日とその理由、欠けている情報や誤っている情報を、自由に書いてください。AIがこのピンの出典と照らし合わせ、より良い情報源を探し、裏付けとなるページがあれば参考資料として追加します。ピン自身の出典が引き続き最も重視されます。AIは画像も確認します。別のものが写っている画像や写りの悪い画像は、後ろに回すか差し替えます。