- 시작
- 2026년 6월 30일신뢰도 90%출처 제공
Claude Sonnet 5 출시
원문에서 자동 번역됨
원본 제목: Claude Sonnet 5 Released
- “Claude Sonnet 5는 지금까지 나온 가장 에이전트적인 Sonnet 모델로 만들어졌다”: 계획을 세우고, 브라우저와 터미널 같은 도구를 사용하며, 자율적으로 실행되고, 더 낮은 가격에 Opus 4.8에 근접한 성능을 낸다.[1][3][4]
- 출시 시점부터 Free와 Pro 요금제의 기본 모델이었으며 Max, Team, Enterprise에서도 이용할 수 있었다. Claude API에서는 claude-sonnet-5로 제공되며, Chat, Cowork, Claude Code, Claude Platform 전반에서 더 높은 사용량 제한이 적용된다.[1]
- “8월 31일까지” 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 10달러로 출시됐으며, 이후 3달러·15달러로 오를 예정이었다. 그러나 2026년 8월 10일 Anthropic는 이 출시 초기 가격을 영구적으로 유지하기로 했다.[1][3][4]
- 정렬 이탈(misalignment) 행동은 Sonnet 4.6보다는 적지만 Opus 4.8과 Claude Mythos Preview보다는 많다. 사이버보안 훈련은 한 번도 받지 않아 작동하는 Firefox 익스플로잇을 만들지 못했지만, Opus 4.7과 4.8에 쓰인 사이버 안전장치를 갖추고 출시됐다.[1][5]
- Sonnet 4.6을 그대로 대체할 수 있는 업그레이드다: 적응형 사고(adaptive thinking)가 기본으로 켜져 있으며, 수동으로 확장 사고를 설정하거나 temperature, top_p, top_k를 기본값이 아닌 값으로 설정하면 이제 오류가 발생한다.[2]
주요 특징
- 사양: 컨텍스트 윈도우 100만 토큰, 최대 출력 토큰 12만 8,000개(베타 상태의 Batch API에서는 30만 개), 기본값이 High인 적응형 사고, 텍스트·이미지 입력에 텍스트 출력, 지식 컷오프는 2026년 1월이다.[2]
- Anthropic의 표에 따르면 SWE-bench Pro에서 63.2%, Terminal-Bench 2.1에서 80.4%, OSWorld-Verified에서 81.2%를 기록해, Sonnet 4.6의 58.1%, 67.0%, 78.5%와 Opus 4.8의 69.2%, 82.7%, 83.4%와 비교된다.[1][3]
- 지식 작업(GDPval-AA v2)에서는 1618점으로 Opus 4.8의 1615점을 근소하게 앞섰고 Sonnet 4.6의 1395점을 크게 앞섰다.[1][3]
- Opus 4.7과 마찬가지로 새로운 토크나이저를 사용해, 동일한 입력이 대략 1.0배에서 1.35배 더 많은 토큰으로 처리된다.[1]
- 낮음(low)부터 최대(max)까지의 노력 수준을 통해 사용자는 비용과 정확도를 맞바꿀 수 있으며, high 노력 수준에서는 일부 작업에서 Opus 4.8과 맞먹는다.[1]
벤치마크[1]
| 벤치마크 | Sonnet 5 | Sonnet 4.6 | Opus 4.8 (for reference) |
|---|---|---|---|
| 에이전트 코딩 (SWE-bench Pro) | 63.2% | 58.1% | 69.2% |
| 에이전트 코딩 (Terminal-Bench 2.1) | 80.4% | 67.0% | 82.7% |
| 다학제적 추론 (Humanity's Last Exam), 도구 미사용 | 43.2% | 34.6% | 49.8% |
| 다학제적 추론 (Humanity's Last Exam), 도구 사용 | 57.4% | 46.8% | 57.9% |
| 컴퓨터 사용 (OSWorld-Verified) | 81.2% | 78.5% | 83.4% |
| 지식 작업 (GDPval-AA v2) | 1618 | 1395 | 1615 |
참고자료 5신뢰도 88%종합 신뢰도: 88%핀의 출처와 참고 자료가 날짜를 얼마나 뒷받침하는지.출처를 포함한 자료 5건이 핀의 시작·종료 시각을 얼마나 강하게 뒷받침하는지에 대한 가중 평균. 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다신뢰도 75% 이상 핀 모두 보기
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]90%anthropic.com/news/claude-sonnet-5anthropic.com· 게시 2026년 9월 28일· 시작 2026년 6월 30일 ✓· 점수의 24%
게시물은 “Jun 30, 2026”로 날짜가 표시돼 있으며 “오늘부터 Claude[2] Sonnet 5는 모든 요금제에서 이용할 수 있다”고 밝혔다. 문서 페이지에는 “Released June 30, 2026”라고 나와 있고, TechCrunch[3]의 2026년 6월 30일자 보도는 “화요일부터” 기본 모델이 된다고 전했다.
- [2]90%Claude Sonnet 5 - Claude Platform Docsplatform.claude.com· 추가 2026년 9월 28일· 점수의 24%
Anthropic's[1][5] model page: claude-sonnet-5, a drop-in upgrade for Sonnet 4.6 with adaptive thinking on by default, 1M-token context, 128K max output (300K Batch beta), $2/$10 per million tokens, text and images in, a January 2026 knowledge cutoff, "Released June 30, 2026".
- [3]88%Anthropic launches Claude Sonnet 5 as a cheaper way to run agentstechcrunch.com· 게재 2026년 6월 30일· 시작 2026년 6월 30일· 점수의 17%
TechCrunch, 2026-06-30: default for Free and Pro "Starting Tuesday"; $2/$10 per million tokens through August 31, then $3/$15, cheaper than Opus 4.8, GPT-5.5 and Gemini 3.1 Pro but dearer than Gemini 3.5 Flash; 63.2% on agentic coding against Opus 4.8's 69.2% and Sonnet 4.6's 58.1%.
- [4]80%Anthropic Launches Claude Sonnet 5 With Near-Opus Performance at a Lower Pricemacrumors.com· 게재 2026년 6월 30일· 시작 2026년 6월 30일· 점수의 17%
MacRumors, 2026-06-30: "Anthropic[1][5] today introduced Claude[2] Sonnet 5", its most agentic Sonnet, with performance similar to Opus 4.8, lower hallucination and sycophancy, and the launch pricing of $2/$10 before a planned rise to $3/$15.
- [5]90%System Card: Claude Sonnet 5anthropic.com· 게재 2026년 6월 30일· 점수의 17%
Anthropic's[1] system card dated "June 30, 2026", describing "the latest model in Anthropic's Sonnet family" as an upgrade to Claude[2] Sonnet 4.6, with the behavioural audit and Firefox exploit results the launch post cites.
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다. AI는 이미지도 확인합니다. 다른 것을 보여주거나 제대로 보여주지 못하는 이미지는 뒤로 옮기거나 교체합니다.