- 시작
- 2024년 3월 13일신뢰도 90%출처 제공
Claude 3 Haiku 출시
원문에서 자동 번역됨
원본 제목: Claude 3 Haiku Released
- Anthropic는 2024년 3월 4일 Opus, Sonnet과 함께 Claude 3 Haiku를 “곧 이용 가능”이라고 발표했고, 3월 13일 Claude API와 claude.ai(Claude Pro 구독자 대상)에서 출시했다.[1][5]
- 같은 날 Amazon Bedrock에도 도입됐으며, Google Cloud Vertex AI는 “곧 도입될 예정”이었다.[1][4]
- Anthropic는 분기 보고서, 계약서, 법률 사건 등 대량의 문서를 분석해야 하는 기업들을 겨냥해, “동급 성능의 다른 모델 대비 절반의 비용”이라고 소개했다.[1][3]
- 이 모델은 Claude API에 2년을 조금 넘는 기간 동안 유지됐다. 2026년 2월 19일 지원 종료됐고 2026년 4월 20일 Claude Haiku 4.5로 대체되며 완전히 퇴역했다.[2]
주요 특징
- Claude 3 모델 중 가장 빠르고 가장 작은 모델로, 입력 토큰 100만 개당 0.25달러, 출력 토큰 100만 개당 1.25달러로 가격이 책정됐다. 이는 긴 프롬프트를 쓰는 기업 업무를 위해 설계된 1:5 비율이다.[1][5]
- 3만 2,000토큰 미만의 프롬프트에서는 초당 2만 1,000토큰(약 30쪽)을 처리하며, “대다수 워크로드에서 동급 모델보다 3배 빠르다”. 1달러로 미국 연방최고법원(Supreme Court) 사건 400건 또는 이미지 2,500장을 분석할 수 있다.[1][3]
- Anthropic가 발표한 벤치마크: MMLU 75.2%, HumanEval 75.9%, GSM8K 88.9%, GPQA Diamond 33.3%로, 대부분의 항목에서 GPT-3.5와 Gemini 1.0 Pro를 앞섰다.[1]
- 컨텍스트 윈도우는 20만 토큰이며, Claude 3 패밀리의 비전 기능을 갖춰 사진, 차트, 도표를 읽을 수 있다.[1][4]
벤치마크[1]
| 벤치마크 | Claude 3 Haiku | GPT-3.5 | Gemini 1.0 Pro |
|---|---|---|---|
| 가격, 입력/출력 | $0.25 / $1.25 | $0.50 / $1.50 | $0.47 / $1.42 |
| MMLU (학부 수준 지식) | 75.2% 5-shot | 70.0% 5-shot | 71.8% 5-shot |
| GPQA, Diamond (대학원 수준 추론) | 33.3% 0-shot CoT | 28.1% 0-shot CoT | — |
| GSM8K (초등 수학) | 88.9% 0-shot CoT | 57.1% 5-shot | 86.5% Maj1@32 |
| MATH (수학 문제 해결) | 40.9% 4-shot | 34.1% 4-shot | 32.6% 4-shot |
| MGSM (다국어 수학) | 76.5% 8-shot | — | 63.5% 8-shot |
| HumanEval (코드) | 75.9% 0-shot | 48.1% 0-shot | 67.7% 0-shot |
| DROP, F1 score (텍스트 기반 추론) | 78.4 3-shot | 64.1 3-shot | 74.1 Variable shots |
| BIG-Bench-Hard (혼합 평가) | 73.7% 3-shot CoT | 66.6% 3-shot CoT | 75.0% 3-shot CoT |
| ARC-Challenge (지식 질의응답) | 89.2% 25-shot | 85.2% 25-shot | — |
| HellaSwag (상식) | 85.9% 10-shot | 85.5% 10-shot | 84.7% 10-shot |
| 비전 지원 여부 | 예 | 아니오 | 예 |
참고자료 5신뢰도 90%종합 신뢰도: 90%핀의 출처와 참고 자료가 날짜를 얼마나 뒷받침하는지.출처를 포함한 자료 5건이 핀의 시작·종료 시각을 얼마나 강하게 뒷받침하는지에 대한 가중 평균. 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다신뢰도 75% 이상 핀 모두 보기
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]90%anthropic.com/news/claude-3-haikuanthropic.com· 게시 2026년 9월 28일· 시작 2024년 3월 13일 ✓· 점수의 48%
Anthropic[5]의 게시물은 “Mar 13, 2024”로 날짜가 표시돼 있으며 “오늘 Claude[2] 3 Haiku를 출시한다... 이 모델은 이제 Claude API와 claude.ai에서 Sonnet, Opus와 함께 Claude Pro 구독자들에게 제공된다”고 밝혔다. AWS도 같은 날 Amazon[4] Bedrock에서의 제공을 발표했다.
- [2]90%Model deprecations - Claude Platform Docsplatform.claude.com· 추가 2026년 9월 28일· 점수의 48%
Anthropic[1][5] notified developers on 19 February 2026 that Claude Haiku 3 (claude-3-haiku-20240307) would be retired; it was retired on 20 April 2026, with claude-haiku-4-5-20251001 as the replacement.
- [3]75%Anthropic releases affordable, high-speed Claude 3 Haiku modelsiliconangle.com· 게재 2024년 3월 14일· 점수의 1%
SiliconANGLE's report: Haiku processes up to 21,000 tokens (about 30 pages) per second for prompts under 32,000 tokens, uses a 1:5 input-to-output pricing ratio, and joins Sonnet on Amazon[4] Bedrock, with Google Cloud Vertex AI coming soon.
- [4]85%Anthropic's Claude 3 Haiku model is now available on Amazon Bedrockaws.amazon.com· 게재 2024년 3월 13일· 시작 2024년 3월 13일· 점수의 1%
AWS News Blog, published 2024-03-13T15:27-07:00: "Today, we are announcing the availability of Claude[2] 3 Haiku on Amazon Bedrock"; like Sonnet and Opus it has image-to-text vision, multilingual skills and a 200K context window.
- [5]90%Introducing the next generation of Claudeanthropic.com· 게재 2024년 3월 4일· 점수의 1%
The 4 March 2024 family launch, where Haiku was announced but not yet released ("Haiku will be available soon"): $0.25 per million input and $1.25 per million output tokens, a 200K context window, and it reads a ~10k-token arXiv paper with charts in under three seconds.[1]
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다. AI는 이미지도 확인합니다. 다른 것을 보여주거나 제대로 보여주지 못하는 이미지는 뒤로 옮기거나 교체합니다.