- 시작
- 2024년 3월 4일신뢰도 95%anthropic.com 제공
Claude 3 Sonnet 출시
원문에서 자동 번역됨
원본 제목: Claude 3 Sonnet Released
- Anthropic는 2024년 3월 4일 Haiku, Sonnet, Opus로 구성된 Claude 3 패밀리를 발표했으며, Opus와 Sonnet은 “이제 claude.ai와 Claude API에서 이용 가능”해졌고 이후 159개국에서 정식 서비스됐다. Haiku는 뒤이어 나올 예정이었다.[3]
- Sonnet은 “claude.ai의 무료 이용 경험”을 구동했고, Opus는 Claude Pro 구독자 전용이었다. Sonnet은 같은 날 Amazon Bedrock에 도입됐고 Google Cloud의 Vertex AI Model Garden에서는 비공개 프리뷰로 제공됐다.[3][4]
- Anthropic는 이를 “특히 기업용 워크로드에서 지능과 속도 사이의 이상적인 균형을 이루는” 모델로 소개했으며, 대부분의 워크로드에서 Claude 2 및 Claude 2.1보다 두 배 빠르다고 밝혔다.[3][4]
- 이 패밀리는 Anthropic의 책임 있는 확장 정책(Responsible Scaling Policy)에 따라 AI Safety Level 2(ASL-2)를 유지했으며, 가드레일에 근접한 무해한 프롬프트를 거부하는 빈도가 이전 Claude 모델들보다 훨씬 낮다.[3]
- Anthropic가 2025년 7월 Claude 3 Sonnet을 퇴역시켰을 때, 샌프란시스코에서 약 200명이 모여 “장례식”을 열었다.[2]
주요 특징
- 입력 토큰 100만 개당 3달러, 출력 토큰 100만 개당 15달러로 가격이 책정됐으며, 컨텍스트 윈도우는 20만 토큰이다.[3]
- 비전 기능을 갖춘 최초의 Claude 세대로, 사진·차트·그래프·기술 도표를 읽어내며 한 번의 요청에 이미지를 최대 20장까지 처리할 수 있지만, Anthropic는 사람 식별 기능은 막아두었다.[1][5]
- 모델 카드 벤치마크: MMLU(5-shot) 79.0%, GPQA Diamond 40.4%, GSM8K 92.3%, HumanEval 파이썬 코딩 73.0%.[1]
- Amazon Web Services와 Google Cloud 하드웨어에서 PyTorch, JAX, Triton을 사용해 훈련됐다. 2023년 8월 이전 데이터를 바탕으로 답변하며 웹을 검색할 수는 없다.[1][5]
- Anthropic가 제시한 활용 사례: 대규모 지식 베이스 검색, 제품 추천 및 예측, 코드 생성, 이미지에서 텍스트 파싱.[3]
벤치마크[3]
| 벤치마크 | Claude 3 Opus | Claude 3 Sonnet | Claude 3 Haiku | GPT-4 | GPT-3.5 | Gemini 1.0 Ultra | Gemini 1.0 Pro |
|---|---|---|---|---|---|---|---|
| 학부 수준 지식 (MMLU) | 86.8% (5-shot) | 79.0% (5-shot) | 75.2% (5-shot) | 86.4% (5-shot) | 70.0% (5-shot) | 83.7% (5-shot) | 71.8% (5-shot) |
| 대학원 수준 추론 (GPQA, Diamond) | 50.4% (0-shot CoT) | 40.4% (0-shot CoT) | 33.3% (0-shot CoT) | 35.7% (0-shot CoT) | 28.1% (0-shot CoT) | — | — |
| 초등 수학 (GSM8K) | 95.0% (0-shot CoT) | 92.3% (0-shot CoT) | 88.9% (0-shot CoT) | 92.0% (5-shot CoT) | 57.1% (5-shot) | 94.4% (Maj1@32) | 86.5% (Maj1@32) |
| 수학 문제 해결 (MATH) | 60.1% (0-shot CoT) | 43.1% (0-shot CoT) | 38.9% (0-shot CoT) | 52.9% (4-shot) | 34.1% (4-shot) | 53.2% (4-shot) | 32.6% (4-shot) |
| 다국어 수학 (MGSM) | 90.7% (0-shot) | 83.5% (0-shot) | 75.1% (0-shot) | 74.5% (8-shot) | — | 79.0% (8-shot) | 63.5% (8-shot) |
| 코드 (HumanEval) | 84.9% (0-shot) | 73.0% (0-shot) | 75.9% (0-shot) | 67.0% (0-shot) | 48.1% (0-shot) | 74.4% (0-shot) | 67.7% (0-shot) |
| 텍스트 기반 추론 (DROP, F1 score) | 83.1 (3-shot) | 78.9 (3-shot) | 78.4 (3-shot) | 80.9 (3-shot) | 64.1 (3-shot) | 82.4 (variable shots) | 74.1 (variable shots) |
| 혼합 평가 (BIG-Bench-Hard) | 86.8% (3-shot CoT) | 82.9% (3-shot CoT) | 73.7% (3-shot CoT) | 83.1% (3-shot CoT) | 66.6% (3-shot CoT) | 83.6% (3-shot CoT) | 75.0% (3-shot CoT) |
| 지식 질의응답 (ARC-Challenge) | 96.4% (25-shot) | 93.2% (25-shot) | 89.2% (25-shot) | 96.3% (25-shot) | 85.2% (25-shot) | — | — |
| 상식 (HellaSwag) | 95.4% (10-shot) | 89.0% (10-shot) | 85.9% (10-shot) | 95.3% (10-shot) | 85.5% (10-shot) | 87.8% (10-shot) | 84.7% (10-shot) |
참고자료 5신뢰도 83%종합 신뢰도: 83%핀의 출처와 참고 자료가 날짜를 얼마나 뒷받침하는지.출처를 포함한 자료 5건이 핀의 시작·종료 시각을 얼마나 강하게 뒷받침하는지에 대한 가중 평균. 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다신뢰도 75% 이상 핀 모두 보기
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]90%anthropic.com/claude-3-model-cardanthropic.com· 게시 2026년 9월 28일· 시작 2024년 3월 4일· 점수의 48%
모델 카드에는 출시일이 없어, 날짜는 출시 게시물의 것을 따른다: “차세대 Claude 소개, Mar 4, 2024” - “Opus와 Sonnet은 이제 claude.ai와 Claude API에서 이용할 수 있다”. AWS의 2024년 3월 4일자 게시물은 “오늘 Amazon[4] Bedrock에서 Anthropic[3]의 Claude 3 Sonnet을 이용할 수 있게 됐다”고 발표했다.
- [2]75%Claude (AI) - Wikipediaen.wikipedia.org· 추가 2026년 9월 28일· 점수의 48%
The Sonnet table lists Claude 3 Sonnet as released 4 March 2024 and discontinued; the article adds that when Anthropic[1][3] retired it in July 2025 around 200 people gathered in San Francisco for a "funeral".
- [3]95%Introducing the next generation of Claudeanthropic.com· 게재 2024년 3월 4일· 시작 2024년 3월 4일 ✓· 점수의 1%
Anthropic's[1] launch post, dated "Mar 4, 2024": "Opus and Sonnet are now available to use in claude.ai and the Claude API which is now generally available in 159 countries", with Sonnet at $3/$15 per million tokens and a 200K context window, powering the free claude.ai. The model card that is the source carries no launch date, so this row dates the pin.
- [4]90%Anthropic's Claude 3 Sonnet foundation model is now available in Amazon Bedrockaws.amazon.com· 게재 2024년 3월 4일· 시작 2024년 3월 4일· 점수의 1%
AWS News Blog post by Channy Yun, 04 MAR 2024: "We're also announcing the availability of Anthropic's[1][3] Claude 3 Sonnet today in Amazon Bedrock, with Claude 3 Opus and Claude 3 Haiku coming soon"; Sonnet is two times faster than Claude 2 and 2.1.
- [5]85%Anthropic claims its new AI chatbot models beat OpenAI's GPT-4techcrunch.com· 게재 2024년 3월 4일· 시작 2024년 3월 4일· 점수의 1%
TechCrunch's same-day report: Opus and Sonnet "are available now on the web and via Anthropic's[1][3] dev console and API, Amazon's[4] Bedrock platform and Google's Vertex AI"; Claude 3 is Anthropic's first multimodal model, takes up to 20 images per request, cannot identify people and answers only from data before August 2023.
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다. AI는 이미지도 확인합니다. 다른 것을 보여주거나 제대로 보여주지 못하는 이미지는 뒤로 옮기거나 교체합니다.