- Начало
- 31 янв. 2025 г.ДОСТОВЕРНОСТЬ 95%от help.openai.com
Выпущена OpenAI o3-mini
Автоматический перевод оригинала
Оригинальное название: OpenAI o3-mini Released
- OpenAI выпустила o3-mini 31 января 2025 года в ChatGPT и API; в примечаниях к выпускам OpenAI зафиксировано, что 56% экспертов предпочли её o1-mini[1][2]
- Впервые версия модели бесплатна для пользователей ChatGPT, с ограничениями по частоте запросов; платные пользователи могут выбрать o3-mini-high, а сама модель поддерживает поиск со ссылками на веб-источники[2]
- Доступ к API — через Chat Completions, Assistants и Batch API[2]
- В новостной сводке того же дня также говорится о бесплатной o1 («Think Deeper») в Microsoft Copilot, партнёрстве с национальными лабораториями и сообщениях об инвестиционных планах SoftBank и Stargate, которые не связаны с запуском o3-mini[2]
Примечательные особенности
- Первая малая рассуждающая модель OpenAI с поддержкой вызова функций, Structured Outputs и сообщений разработчика, с потоковой передачей и выбором низких, средних или высоких усилий на рассуждение; зрение она не поддерживает[3]
- При средних усилиях на рассуждение она не уступает o1 на оценках по математике, программированию и науке, включая AIME и GPQA; при высоких усилиях и с инструментом Python с первой попытки решает более 32% задач FrontierMath[3]
- Ответы приходят на 24 процента быстрее, чем у o1-mini, и точнее; модель сильна в математике, программировании и науке и показывает ход своих рассуждений[2]
- В A/B-тестировании ответы занимали в среднем 7.7 секунды против 10.16 секунды у o1-mini, время до первого токена было на 2,500 мс меньше, а эксперты-тестировщики увидели на 39% меньше серьёзных ошибок на сложных вопросах из реальной жизни[3]
- Модель обучали методом deliberative alignment: перед ответом она рассуждает о написанных людьми спецификациях безопасности[3]
Источники 3ДОСТОВЕРНОСТЬ 92%Общая достоверность: 92%Насколько источник и ссылки пина подтверждают его даты.Взвешенное среднее того, насколько 3 источника, включая основной, подтверждают время начала и окончания пина; вес источника уменьшается вдвое за каждые 180 дней разницы с самым новымПоказать все пины с достоверностью 75% и выше
Первая запись — всегда источник пина. Общая достоверность — это взвешенное среднее того, насколько каждый источник подтверждает указанные выше время начала и окончания; вес источника уменьшается вдвое за каждые 180 дней разницы с самым новым.
- [1]95%OpenAI Model Release Notes: Introducing OpenAI o3-mini (January 31, 2025)help.openai.com· Размещено 19 сент. 2026 г.· Начало 31 янв. 2025 г.· 83% оценки
Собственные примечания OpenAI к выпускам моделей относят эту запись к 31 января 2025 года
- [2]70%The OpenAI Daily Brief: o3-Mini Model, U.S. Energy Collaboration, and SoftBank's Stargate Investmentpodcasts.apple.com· Опубликовано 31 янв. 2025 г.· 8% оценки
The OpenAI[1] Daily Brief's episode "o3-Mini Model, U.S. Energy Collaboration, and SoftBank's Stargate Investment" (2025-01-31) says: "AI reasoning faster and more accessible than ever!? Welcome to The OpenAI Weekly Brief, your go-to for the latest AI updates. Today is Friday, January 31st , 2025. Here’s what you need to know about OpenAI's groundbreaking launch of the o3-mini reasoning model. Let’s dive in. OpenAI has just unveiled its"
- [3]88%OpenAI o3-mini | OpenAI (Wayback Machine copy)web.archive.org· Опубликовано 31 янв. 2025 г.· 8% оценки
Archived copy of OpenAI's[1] o3-mini announcement, which says it is "our first small reasoning model that supports ... function calling, Structured Outputs, and developer messages", offers low, medium and high reasoning effort, and averaged "7.7 seconds compared to 10.16 seconds" for o1-mini.
Предложить исправление
Чего-то не хватает или есть ошибка? Напишите своими словами: ссылку, подтверждающую этот пин, другую дату начала или окончания и почему, или факт, которого нет или который неверен. ИИ сверит это с источниками пина, поищет лучшие и добавит любую страницу, которая вас подтверждает. Собственные источники пина всё равно весят больше всего. Изображение, на котором показано что-то другое или показано плохо, тоже проверяется и опускается ниже или заменяется.