- Начало
- 4 нояб. 2024 г.ДОСТОВЕРНОСТЬ 92%от platform.claude.com
Выпущена Claude 3.5 Haiku
Автоматический перевод оригинала
Оригинальное название: Claude 3.5 Haiku Released
- 22 октября 2024 г. Anthropic объявила о Claude 3.5 Haiku вместе с обновлённой Claude 3.5 Sonnet и работой с компьютером, а 4 ноября выпустила её в Claude API, Amazon Bedrock и Vertex AI от Google Cloud[2][5][6]
- Она вышла по цене 1 доллар за миллион входных токенов и 5 долларов за миллион выходных — вчетверо выше цены Claude 3 Haiku — после того как Anthropic заявила, что в финальном тестировании она «превзошла Claude 3 Opus, наш прежний флагман, во многих бенчмарках»[4]
- Она вышла только с поддержкой текста; Claude 3 Haiku оставалась доступной для пользователей, которым нужны «максимальная экономичность и обработка изображений», а поддержка зрения появилась 24 февраля 2025 г.[2][4]
- В обновлении от 3 декабря 2024 г. Anthropic снизила цену до 0.80 и 4 долларов за миллион токенов[6]
- Объявлена устаревшей 19 декабря 2025 г. и выведена из Claude API 19 февраля 2026 г., её заменила Claude Haiku 4.5[3]
Примечательные особенности
- Следующее поколение самой быстрой модели Anthropic: при скорости, близкой к Claude 3 Haiku, она «улучшается во всех навыках», а во многих случаях сравнима с первоначальной Claude 3.5 Sonnet и Claude 3 Opus[1][6]
- Программирование: 40.6% в SWE-bench Verified — выше, чем 33.4% у первоначальной Claude 3.5 Sonnet и 22.2% у Claude 3 Opus, и 74% во внутреннем тесте Anthropic на агентное программирование против 38% у Opus[1][6]
- Другие заявленные результаты: 88.1% в HumanEval, 41.6% в GPQA Diamond, 65.0% в MMLU Pro и 51.0% в TAU-bench retail против 75.9%, 33.3%, 49.0% и 18.2% у Claude 3 Haiku[1]
- Граница знаний — июль 2024 г., более свежая, чем у Claude 3 Haiku, и более длинные ответы; предназначена для пользовательских продуктов, задач субагентов и персонализации на основе больших наборов данных[1][4][6]
Бенчмарки[6]
| Бенчмарк | Claude 3.5 Sonnet (новая) | Claude 3.5 Haiku | Claude 3.5 Sonnet | GPT-4o* | GPT-4o mini* | Gemini 1.5 Pro | Gemini 1.5 Flash |
|---|---|---|---|---|---|---|---|
| GPQA (Diamond) (рассуждения уровня магистратуры) | 65.0% 0-shot CoT | 41.6% 0-shot CoT | 59.4% 0-shot CoT | 53.6% 0-shot CoT | 40.2% 0-shot CoT | 59.1% 0-shot CoT | 51.0% 0-shot CoT |
| MMLU Pro (знания уровня бакалавриата) | 78.0% 0-shot CoT | 65.0% 0-shot CoT | 75.1% 0-shot CoT | — | — | 75.8% 0-shot CoT | 67.3% 0-shot CoT |
| HumanEval (код) | 93.7% 0-shot | 88.1% 0-shot | 92.0% 0-shot | 90.2% 0-shot | 87.2% 0-shot | — | — |
| MATH (решение математических задач) | 78.3% 0-shot CoT | 69.2% 0-shot CoT | 71.1% 0-shot CoT | 76.6% 0-shot CoT | 70.2% 0-shot CoT | 86.5% 4-shot CoT | 77.9% 4-shot CoT |
| AIME 2024 (олимпиада по математике для старшеклассников) | 16.0% 0-shot CoT | 5.3% 0-shot CoT | 9.6% 0-shot CoT | 9.3% 0-shot CoT | — | — | — |
| MMMU (вопросы и ответы по изображениям) | 70.4% 0-shot CoT | — | 68.3% 0-shot CoT | 69.1% 0-shot CoT | 59.4% 0-shot CoT | 65.9% 0-shot CoT | 62.3% 0-shot CoT |
| SWE-bench Verified (агентное программирование) | 49.0% | 40.6% | 33.4% | — | — | — | — |
| TAU-bench (агентное использование инструментов) | Розница 69.2%, Авиаперевозки 46.0% | Розница 51.0%, Авиаперевозки 22.8% | Розница 62.6%, Авиаперевозки 36.0% | — | — | — | — |
* В таблицы оценок Anthropic не входит семейство моделей o1 от OpenAI, которое зависит от длительных вычислений до ответа, что затрудняет сравнения.
Источники 6ДОСТОВЕРНОСТЬ 90%Общая достоверность: 90%Насколько источник и ссылки пина подтверждают его даты.Взвешенное среднее того, насколько 6 источников, включая основной, подтверждают время начала и окончания пина; вес источника уменьшается вдвое за каждые 180 дней разницы с самым новымПоказать все пины с достоверностью 75% и выше
Первая запись — всегда источник пина. Общая достоверность — это взвешенное среднее того, насколько каждый источник подтверждает указанные выше время начала и окончания; вес источника уменьшается вдвое за каждые 180 дней разницы с самым новым.
- [1]90%assets.anthropic.com/m/1cd9d098ac3e6467/original/Claude-3-Model-Card-October-Addendum.pdfassets.anthropic.com· Размещено 28 сент. 2026 г.· Начало 4 нояб. 2024 г.· 31% оценки
Примечания к выпуску Claude[2][3]: «4 ноября 2024 г. Claude Haiku 3.5 теперь доступна в Claude API как модель только для текста»; TechCrunch[4] (10:24 по тихоокеанскому времени, 4 ноября 2024 г.) сообщает, что «новейшая модель ИИ Anthropic[6] появилась», а AWS в тот же день объявила о доступности в Bedrock. В публикации от 22 октября говорилось, что она «будет выпущена позже в этом месяце».
- [2]92%Claude Platform release notes - Claude Platform Docsplatform.claude.com· Добавлено 28 сент. 2026 г.· Начало 4 нояб. 2024 г. ✓· 31% оценки
Anthropic's[1][6] own dated changelog: "November 4th, 2024 Claude[3] Haiku 3.5 is now available on the Claude API as a text-only model", and on 24 February 2025 "We've added vision support to Claude Haiku 3.5". The model card addendum that is the source carries no release date, so this entry dates the pin.
- [3]90%Model deprecations - Claude Platform Docsplatform.claude.com· Добавлено 28 сент. 2026 г.· 31% оценки
Anthropic[1][6] notified developers on 19 December 2025 that Claude[2] Haiku 3.5 (claude-3-5-haiku-20241022) would be retired; it was retired on 19 February 2026, with claude-haiku-4-5-20251001 as the replacement.
- [4]88%Anthropic hikes the price of its Haiku modeltechcrunch.com· Опубликовано 4 нояб. 2024 г.· Начало 4 нояб. 2024 г.· 2% оценки
TechCrunch (Kyle Wiggers, 10:24 AM PST, 4 November 2024): "Anthropic's[1][6] newest AI model has arrived"; it costs $1 per million input and $5 per million output tokens against Claude[2][3] 3 Haiku's $0.25 and $1.25, "a 4x hike", quoting Anthropic that "we've increased pricing for Claude 3.5 Haiku to reflect its increase in intelligence", and it launches without image analysis.
- [5]85%Anthropic's Claude 3.5 Haiku model now available in Amazon Bedrockaws.amazon.com· Опубликовано 4 нояб. 2024 г.· Начало 4 нояб. 2024 г.· 2% оценки
AWS What's New, "Posted on: Nov 4, 2024": Claude[2][3] 3.5 Haiku is now available in Amazon Bedrock and "surpasses even Claude 3 Opus, the largest model in Anthropic's[1][6] previous generation, on many intelligence benchmarks—including coding".
Предложить исправление
Чего-то не хватает или есть ошибка? Напишите своими словами: ссылку, подтверждающую этот пин, другую дату начала или окончания и почему, или факт, которого нет или который неверен. ИИ сверит это с источниками пина, поищет лучшие и добавит любую страницу, которая вас подтверждает. Собственные источники пина всё равно весят больше всего. Изображение, на котором показано что-то другое или показано плохо, тоже проверяется и опускается ниже или заменяется.