- 시작
- 2025년 1월 31일신뢰도 95%help.openai.com 제공
OpenAI o3-mini 출시
원문에서 자동 번역됨
원본 제목: OpenAI o3-mini Released
- OpenAI는 2025년 1월 31일 ChatGPT와 API에 o3-mini를 출시했다. OpenAI의 릴리스 노트는 o1-mini 대비 전문가 선호도 56%를 기록했다고 밝히고 있다[1][2]
- 처음으로 ChatGPT 이용자에게 무료로 제공되는 버전이며(사용량 제한 있음), 유료 이용자는 o3-mini-high를 선택할 수 있고 출처 링크가 포함된 검색 기능도 지원된다[2]
- API 접근은 Chat Completions, Assistants, Batch API를 통해 이뤄진다[2]
- 같은 날의 뉴스 브리핑은 마이크로소프트 코파일럿의 무료 o1(“Think Deeper”), 국립연구소와의 협력, 소프트뱅크와 스타게이트 투자 계획 보도도 함께 다루지만 이는 o3-mini 출시와는 별개다[2]
주요 특징
- 함수 호출, 구조화된 출력, 개발자 메시지를 지원하고 스트리밍과 낮음·중간·높음 추론 강도 선택이 가능한 OpenAI 최초의 소형 추론 모델이며, 비전은 지원하지 않는다[3]
- 중간 추론 강도에서 AIME·GPQA를 포함한 수학·코딩·과학 평가에서 o1과 대등하며, 높은 강도와 파이썬 도구를 사용하면 FrontierMath 문제의 32% 이상을 첫 시도에 푼다[3]
- 응답 속도는 o1-mini보다 24% 빠르면서 정확도도 더 높고, 수학·코딩·과학에 강하며 추론 과정을 보여준다[2]
- A/B 테스트에서 평균 응답 시간은 7.7초(o1-mini는 10.16초)였고 첫 토큰까지의 시간은 2,500밀리초 더 빨랐으며, 어려운 실제 질문에서 전문가 테스터가 확인한 주요 오류는 39% 줄었다[3]
- 인간이 작성한 안전 규격에 대해 답변 전에 추론하도록 하는 신중한 정렬(deliberative alignment) 방식으로 훈련됐다[3]
참고자료 3신뢰도 92%
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]95%OpenAI Model Release Notes: Introducing OpenAI o3-mini (January 31, 2025)help.openai.com· 게시 2026년 9월 19일· 시작 2025년 1월 31일· 점수의 83%
OpenAI 자체 모델 릴리스 노트는 이 항목의 날짜를 2025년 1월 31일로 기재하고 있다.
- [2]70%The OpenAI Daily Brief: o3-Mini Model, U.S. Energy Collaboration, and SoftBank's Stargate Investmentpodcasts.apple.com· 게재 2025년 1월 31일· 점수의 8%
The OpenAI[1] Daily Brief's episode "o3-Mini Model, U.S. Energy Collaboration, and SoftBank's Stargate Investment" (2025-01-31) says: "AI reasoning faster and more accessible than ever!? Welcome to The OpenAI Weekly Brief, your go-to for the latest AI updates. Today is Friday, January 31st , 2025. Here’s what you need to know about OpenAI's groundbreaking launch of the o3-mini reasoning model. Let’s dive in. OpenAI has just unveiled its"
- [3]88%OpenAI o3-mini | OpenAI (Wayback Machine copy)web.archive.org· 게재 2025년 1월 31일· 점수의 8%
Archived copy of OpenAI's[1] o3-mini announcement, which says it is "our first small reasoning model that supports ... function calling, Structured Outputs, and developer messages", offers low, medium and high reasoning effort, and averaged "7.7 seconds compared to 10.16 seconds" for o1-mini.
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다.