- Начало
- 17 февр. 2026 г.ДОСТОВЕРНОСТЬ 90%от источник
Выпущена Claude Sonnet 4.6
Автоматический перевод оригинала
Оригинальное название: Claude Sonnet 4.6 Released
- «Claude Sonnet 4.6 — наша самая мощная модель Sonnet на сегодняшний день», полное обновление в программировании, работе с компьютером, рассуждениях в длинном контексте, планировании агентов, интеллектуальной работе и дизайне[1][4]
- Она стала моделью по умолчанию в claude.ai и Claude Cowork для пользователей Free и Pro, а бесплатный уровень получил создание файлов, коннекторы, навыки и сжатие контекста; она есть на всех тарифах Claude, в Claude Code, API и на всех крупных облачных платформах[1][3][4]
- В Claude Code ранние тестировщики предпочитали её Sonnet 4.5 примерно в 70% случаев и даже Opus 4.5 — ноябрьскому флагману Anthropic — в 59% случаев, называя её менее склонной к переусложнению и «лени»[1]
- Исследователи безопасности обнаружили «в целом тёплый, честный, просоциальный и порой смешной характер» и никаких признаков серьёзного рассогласования в критичных ситуациях; она гораздо лучше Sonnet 4.5 противостоит внедрению промптов и была выпущена под ASL-3[1][5]
- CNBC связал запуск с распродажей акций программного обеспечения: биржевой фонд программного обеспечения IGV потерял с начала года более 20%[3]
Примечательные особенности
- Цена не изменилась по сравнению с Sonnet 4.5: 3 доллара за миллион входных токенов и 15 долларов за миллион выходных; контекстное окно в 1 млн токенов (в бета-версии при запуске) и максимум 128 тыс. выходных токенов[1][2]
- Таблица Anthropic: 79.6% в SWE-bench Verified, 72.5% в OSWorld-Verified (Sonnet 4.5: 61.4%), 59.1% в Terminal-Bench 2.0 и 74.7% в BrowseComp[1]
- График OSWorld прослеживает линейку Sonnet от 14.9% у Claude 3.5 Sonnet в октябре 2024 г. до 72.5% у Sonnet 4.6[1]
- Адаптивное и расширенное мышление, а также сжатие контекста в бета-версии, которое резюмирует более старый контекст по мере приближения разговора к пределу[1][2]
- Она не уступает Opus 4.6 в OfficeQA — тесте Databricks на чтение корпоративных диаграмм, PDF и таблиц, — а в Vending-Bench Arena она десять смоделированных месяцев активно инвестировала, прежде чем перейти к получению прибыли[1]
Бенчмарки[1]
| Бенчмарк | Sonnet 4.6 | Sonnet 4.5 | Opus 4.6 | Opus 4.5 | Gemini 3 Pro | GPT-5.2 (все модели) |
|---|---|---|---|---|---|---|
| Агентное программирование в терминале (Terminal-Bench 2.0) | 59.1% | 51.0% | 65.4% | 59.8% | 56.2% (54.2% по данным самой компании) | 64.7% (64.0% по данным самой компании, Codex CLI) |
| Агентное программирование (SWE-bench Verified) | 79.6% | 77.2% | 80.8% | 80.9% | 78.0% (Flash) | 80.0% |
| Агентная работа с компьютером (OSWorld-Verified) | 72.5% | 61.4% | 72.7% | 66.3% | — | 38.2% |
| Агентное использование инструментов (τ2-bench), розница | 91.7% | 86.2% | 91.9% | 88.9% | 85.3% | 82.0% |
| Агентное использование инструментов (τ2-bench), телеком | 97.9% | 98.0% | 99.3% | 98.2% | 98.0% | 98.7% |
| Масштабное использование инструментов (MCP-Atlas) | 61.3% | 43.8% | 59.5% | 62.3% | 54.1% | 60.6% |
| Агентный поиск (BrowseComp) | 74.7% | 43.9% | 84.0% | 67.8% | 59.2% (Deep Research) | 77.9% (Pro) |
| Междисциплинарные рассуждения (Humanity's Last Exam), без инструментов | 33.2% | 17.7% | 40.0% | 30.8% | 37.5% | 36.6% (Pro) |
| Междисциплинарные рассуждения (Humanity's Last Exam), с инструментами | 49.0% | 33.6% | 53.0% | 43.4% | 45.8% | 50.0% (Pro) |
| Агентный финансовый анализ (Finance Agent v1.1) | 63.3% | 54.5% | 60.1% | 58.8% | 55.2% | 59.0% |
| Офисные задачи (GDPval-AA Elo) | 1633 | 1276 | 1606 | 1416 | 1201 | 1462 |
| Решение новых задач (ARC-AGI-2) | 58.3% | 13.6% | 68.8% | 37.6% | 31.1% | 54.2% (Pro) |
| Рассуждения уровня магистратуры (GPQA Diamond) | 89.9% | 83.4% | 91.3% | 87.0% | 91.9% | 93.2% (Pro) |
| Визуальные рассуждения (MMMU-Pro), без инструментов | 74.5% | 63.4% | 73.9% | 70.6% | 81.0% | 79.5% |
| Визуальные рассуждения (MMMU-Pro), с инструментами | 75.6% | 68.9% | 77.3% | 73.9% | — | 80.4% |
| Многоязычные вопросы и ответы (MMMLU) | 89.3% | 89.5% | 91.1% | 90.8% | 91.8% | 89.6% |
Источники 5ДОСТОВЕРНОСТЬ 88%Общая достоверность: 88%Насколько источник и ссылки пина подтверждают его даты.Взвешенное среднее того, насколько 5 источников, включая основной, подтверждают время начала и окончания пина; вес источника уменьшается вдвое за каждые 180 дней разницы с самым новымПоказать все пины с достоверностью 75% и выше
Первая запись — всегда источник пина. Общая достоверность — это взвешенное среднее того, насколько каждый источник подтверждает указанные выше время начала и окончания; вес источника уменьшается вдвое за каждые 180 дней разницы с самым новым.
- [1]90%anthropic.com/news/claude-sonnet-4-6anthropic.com· Размещено 28 сент. 2026 г.· Начало 17 февр. 2026 г. ✓· 31% оценки
Публикация датирована «Feb 17, 2026» и сообщает: «Claude[2] Sonnet 4.6 теперь доступна на всех тарифах Claude, в Claude Cowork, Claude Code, нашем API и на всех крупных облачных платформах»; на странице модели в документации указано «Выпущена 17 февраля 2026 г.», и CNBC[3] сообщил об этом в тот же день.
- [2]90%Claude Sonnet 4.6 - Claude Platform Docsplatform.claude.com· Добавлено 28 сент. 2026 г.· 31% оценки
Anthropic's[1][5] model page: claude-sonnet-4-6, 1M-token context, 128K max output (300K Batch beta), $3/$15 per million tokens, adaptive thinking (extended deprecated), text and images in, an August 2025 reliable knowledge cutoff, "Released February 17, 2026".
- [3]85%Anthropic releases Claude Sonnet 4.6, continuing breakneck pace of AI model releasescnbc.com· Опубликовано 17 февр. 2026 г.· Начало 17 февр. 2026 г.· 13% оценки
CNBC, 2026-02-17: the default for free and Pro users in Claude[2] and Claude Cowork, better at computers, coding, design and knowledge work; Anthropic's[1][5] advances had fed a sell-off in software stocks, with the iShares Expanded Tech-Software Sector ETF (IGV) down more than 20% for the year.
- [4]80%Claude Sonnet 4.6 Brings Improved Coding, Computer Use, and Office Tasksmacrumors.com· Опубликовано 17 февр. 2026 г.· Начало 17 февр. 2026 г.· 13% оценки
MacRumors, 2026-02-17: "Anthropic[1][5] today updated its Sonnet model to version 4.6", available on all Claude[2] plans, with file creation, connectors, skills and compaction added for free users; Opus 4.6 stays the better choice for the hardest agentic work.
- [5]90%System Card: Claude Sonnet 4.6anthropic.com· Опубликовано 17 февр. 2026 г.· 13% оценки
Anthropic's[1] system card dated "February 17, 2026", which records the model's release under the AI Safety Level 3 (ASL-3) Standard; a 6 March 2026 changelog entry updated its BrowseComp scores after an improved cheating-detection pipeline.
Предложить исправление
Чего-то не хватает или есть ошибка? Напишите своими словами: ссылку, подтверждающую этот пин, другую дату начала или окончания и почему, или факт, которого нет или который неверен. ИИ сверит это с источниками пина, поищет лучшие и добавит любую страницу, которая вас подтверждает. Собственные источники пина всё равно весят больше всего. Изображение, на котором показано что-то другое или показано плохо, тоже проверяется и опускается ниже или заменяется.