- 시작
- 2026년 2월 17일신뢰도 90%출처 제공
Claude Sonnet 4.6 출시
원문에서 자동 번역됨
원본 제목: Claude Sonnet 4.6 Released
- “Claude Sonnet 4.6은 지금까지 나온 우리의 가장 강력한 Sonnet 모델”로, 코딩, 컴퓨터 사용, 장문 컨텍스트 추론, 에이전트 계획, 지식 작업, 디자인 전반에 걸친 전면적인 업그레이드다.[1][4]
- Free·Pro 사용자를 위한 claude.ai와 Claude Cowork의 기본 모델이 됐으며, 무료 등급에도 파일 생성, 커넥터, 스킬, 압축(compaction) 기능이 추가됐다. 모든 Claude 요금제, Claude Code, API, 모든 주요 클라우드 플랫폼에서 이용할 수 있다.[1][3][4]
- Claude Code에서 초기 테스터들은 약 70%의 경우 Sonnet 4.5보다 이 모델을 선호했고, Anthropic의 11월 주력 모델인 Opus 4.5보다도 59%의 경우 선호했다. 과잉 설계와 “나태함(laziness)”이 덜하다고 평가했다.[1]
- 안전 연구자들은 “전반적으로 따뜻하고, 솔직하고, 이타적이며 때로는 재치 있는 성격”을 확인했으며 중대하고 위험도가 높은 정렬 이탈(misalignment) 징후는 없었다. 프롬프트 인젝션에 대한 저항력이 Sonnet 4.5보다 훨씬 강하며 ASL-3 하에 출시됐다.[1][5]
- CNBC는 이번 출시를 소프트웨어 주식 매도세와 연결지었으며, IGV 소프트웨어 ETF는 연중 20% 넘게 하락한 상태였다.[3]
주요 특징
- 가격은 Sonnet 4.5와 동일하게 입력 토큰 100만 개당 3달러, 출력 토큰 100만 개당 15달러다. 컨텍스트 윈도우는 100만 토큰(출시 당시 베타)이며 최대 출력은 12만 8,000토큰이다.[1][2]
- Anthropic의 표: SWE-bench Verified 79.6%, OSWorld-Verified 72.5%(Sonnet 4.5는 61.4%), Terminal-Bench 2.0 59.1%, BrowseComp 74.7%.[1]
- OSWorld 차트에서 Sonnet 계열은 2024년 10월 Claude 3.5 Sonnet의 14.9%에서 Sonnet 4.6의 72.5%까지 이어진다.[1]
- 적응형 사고와 확장 사고에 더해, 대화가 한도에 가까워지면 이전 컨텍스트를 요약하는 컨텍스트 압축(compaction) 기능도 베타로 제공한다.[1][2]
- Databricks가 기업용 차트, PDF, 표를 읽어내는 능력을 테스트하는 OfficeQA에서는 Opus 4.6과 동등한 성능을 보였고, Vending-Bench Arena에서는 가상의 10개월 동안 대규모로 투자한 뒤 수익으로 전환했다.[1]
벤치마크[1]
| 벤치마크 | Sonnet 4.6 | Sonnet 4.5 | Opus 4.6 | Opus 4.5 | Gemini 3 Pro | GPT-5.2 (all models) |
|---|---|---|---|---|---|---|
| 에이전트 터미널 코딩 (Terminal-Bench 2.0) | 59.1% | 51.0% | 65.4% | 59.8% | 56.2% (54.2%, 자체 보고) | 64.7% (64.0%, 자체 보고, Codex CLI) |
| 에이전트 코딩 (SWE-bench Verified) | 79.6% | 77.2% | 80.8% | 80.9% | 78.0% (Flash) | 80.0% |
| 에이전트 컴퓨터 사용 (OSWorld-Verified) | 72.5% | 61.4% | 72.7% | 66.3% | — | 38.2% |
| 에이전트 도구 사용 (τ2-bench), 소매 | 91.7% | 86.2% | 91.9% | 88.9% | 85.3% | 82.0% |
| 에이전트 도구 사용 (τ2-bench), 통신 | 97.9% | 98.0% | 99.3% | 98.2% | 98.0% | 98.7% |
| 대규모 도구 사용 (MCP-Atlas) | 61.3% | 43.8% | 59.5% | 62.3% | 54.1% | 60.6% |
| 에이전트 검색 (BrowseComp) | 74.7% | 43.9% | 84.0% | 67.8% | 59.2% (Deep Research) | 77.9% (Pro) |
| 다학제적 추론 (Humanity's Last Exam), 도구 미사용 | 33.2% | 17.7% | 40.0% | 30.8% | 37.5% | 36.6% (Pro) |
| 다학제적 추론 (Humanity's Last Exam), 도구 사용 | 49.0% | 33.6% | 53.0% | 43.4% | 45.8% | 50.0% (Pro) |
| 에이전트 금융 분석 (Finance Agent v1.1) | 63.3% | 54.5% | 60.1% | 58.8% | 55.2% | 59.0% |
| 사무 업무 (GDPval-AA Elo) | 1633 | 1276 | 1606 | 1416 | 1201 | 1462 |
| 신규 문제 해결 (ARC-AGI-2) | 58.3% | 13.6% | 68.8% | 37.6% | 31.1% | 54.2% (Pro) |
| 대학원 수준 추론 (GPQA Diamond) | 89.9% | 83.4% | 91.3% | 87.0% | 91.9% | 93.2% (Pro) |
| 시각적 추론 (MMMU-Pro), 도구 미사용 | 74.5% | 63.4% | 73.9% | 70.6% | 81.0% | 79.5% |
| 시각적 추론 (MMMU-Pro), 도구 사용 | 75.6% | 68.9% | 77.3% | 73.9% | — | 80.4% |
| 다국어 질의응답 (MMMLU) | 89.3% | 89.5% | 91.1% | 90.8% | 91.8% | 89.6% |
참고자료 5신뢰도 88%종합 신뢰도: 88%핀의 출처와 참고 자료가 날짜를 얼마나 뒷받침하는지.출처를 포함한 자료 5건이 핀의 시작·종료 시각을 얼마나 강하게 뒷받침하는지에 대한 가중 평균. 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다신뢰도 75% 이상 핀 모두 보기
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]90%anthropic.com/news/claude-sonnet-4-6anthropic.com· 게시 2026년 9월 28일· 시작 2026년 2월 17일 ✓· 점수의 31%
게시물은 “Feb 17, 2026”로 날짜가 표시돼 있으며 “Claude[2] Sonnet 4.6은 이제 모든 Claude 요금제, Claude Cowork, Claude Code, API, 모든 주요 클라우드 플랫폼에서 이용할 수 있다”고 밝혔다. 문서 페이지에는 “Released February 17, 2026”라고 나와 있고 CNBC[3]도 같은 날 이를 보도했다.
- [2]90%Claude Sonnet 4.6 - Claude Platform Docsplatform.claude.com· 추가 2026년 9월 28일· 점수의 31%
Anthropic's[1][5] model page: claude-sonnet-4-6, 1M-token context, 128K max output (300K Batch beta), $3/$15 per million tokens, adaptive thinking (extended deprecated), text and images in, an August 2025 reliable knowledge cutoff, "Released February 17, 2026".
- [3]85%Anthropic releases Claude Sonnet 4.6, continuing breakneck pace of AI model releasescnbc.com· 게재 2026년 2월 17일· 시작 2026년 2월 17일· 점수의 13%
CNBC, 2026-02-17: the default for free and Pro users in Claude[2] and Claude Cowork, better at computers, coding, design and knowledge work; Anthropic's[1][5] advances had fed a sell-off in software stocks, with the iShares Expanded Tech-Software Sector ETF (IGV) down more than 20% for the year.
- [4]80%Claude Sonnet 4.6 Brings Improved Coding, Computer Use, and Office Tasksmacrumors.com· 게재 2026년 2월 17일· 시작 2026년 2월 17일· 점수의 13%
MacRumors, 2026-02-17: "Anthropic[1][5] today updated its Sonnet model to version 4.6", available on all Claude[2] plans, with file creation, connectors, skills and compaction added for free users; Opus 4.6 stays the better choice for the hardest agentic work.
- [5]90%System Card: Claude Sonnet 4.6anthropic.com· 게재 2026년 2월 17일· 점수의 13%
Anthropic's[1] system card dated "February 17, 2026", which records the model's release under the AI Safety Level 3 (ASL-3) Standard; a 6 March 2026 changelog entry updated its BrowseComp scores after an improved cheating-detection pipeline.
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다. AI는 이미지도 확인합니다. 다른 것을 보여주거나 제대로 보여주지 못하는 이미지는 뒤로 옮기거나 교체합니다.