- 시작
- 2024년 9월 12일신뢰도 95%help.openai.com 제공
OpenAI o1-preview·o1-mini 출시
원문에서 자동 번역됨
원본 제목: OpenAI o1-preview and o1-mini Released
- OpenAI는 2024년 9월 12일 o1-preview와 o1-mini를 출시했으며 ChatGPT 주간 메시지 한도는 각각 30회, 50회다[1]
- OpenAI는 9월 12일 두 모델에 대한 시스템 카드를 발표했다[2]
- 2024년 10월의 한 팟캐스트는 o1의 사고연쇄(chain-of-thought) 추론, 복잡한 코딩에서의 강점, GPT-4o와의 안전성 정면 비교 테스트, 탈옥·환각·기만·설득에 대한 평가를 다루며 대본이 아닌 에피소드 설명만을 근거로 한다[2]
- 팟캐스트 설명에 따르면 OpenAI는 GPT-4o로 o1의 행동을 감시했으며, 사이버보안과 허위정보에 대한 자율성·레드팀 테스트를 진행했다[2]
주요 특징
- 답변하기 전에 문제를 더 오래 고민하도록 훈련된 새로운 추론 모델 계열의 첫 번째로, 사고를 다듬고 다양한 전략을 시도하며 실수를 인지하는 법을 학습한다. OpenAI는 카운터를 1로 초기화하고 이 계열을 OpenAI o1이라 명명했다[3]
- OpenAI 테스트에서 당시 개발 중이던 다음 모델 업데이트는 국제수학올림피아드 예선 시험에서 83%(GPT-4o는 13%)를 기록했고, Codeforces 대회에서는 상위 89% 백분위에 들었다[3]
- 새로운 안전 훈련 방식은 모델이 맥락 속에서 안전 규칙을 추론하도록 하며, OpenAI가 가장 어려운 탈옥 테스트 중 하나에서 o1-preview는 100점 만점에 84점을 기록했다(GPT-4o는 22점)[3]
- o1-mini는 더 빠르고 저렴하며 특히 코딩에 효과적인 추론 모델로, o1-preview보다 80% 저렴하다[3]
- 출시 당시 ChatGPT에서는 웹 브라우징과 파일·이미지 업로드가 없었고, API에서는 함수 호출·스트리밍·시스템 메시지가 지원되지 않았으며 사용 등급 5 개발자의 API 접근은 분당 20회 요청으로 제한됐다[3]
참고자료 3신뢰도 93%
첫 번째 항목은 항상 핀의 출처입니다. 전체 신뢰도는 각 자료가 위의 시작·종료 시각을 얼마나 확실히 뒷받침하는지에 대한 가중 평균이며, 자료는 최신 자료보다 180일 오래될 때마다 가중치가 절반이 됩니다.
- [1]95%OpenAI Model Release Notes: Introducing OpenAI o1-preview and o1-mini (September 12, 2024)help.openai.com· 게시 2026년 9월 19일· 시작 2024년 9월 12일· 점수의 89%
OpenAI 자체 모델 릴리스 노트는 이 항목의 날짜를 2024년 9월 12일로 기재하고 있다.
- [2]70%AIandBlockchain: AI's Quantum Leap Unpacking OpenAI's O1 Modelspodcasts.apple.com· 게재 2024년 10월 7일· 점수의 6%
AIandBlockchain's episode "AI's Quantum Leap Unpacking OpenAI's[1] O1 Models" (2024-10-07) says: "a bit unsettling. Join us as we break down the key elements of OpenAI's O1 models, using excerpts from their recently released system card ( September 12th ). We’ll discuss the unique strengths of the O1 Preview and O1 Mini models, highlighting their enhanced ability to handle complex coding tasks, while also"
- [3]88%Introducing OpenAI o1-preview | OpenAI (Wayback Machine copy)web.archive.org· 게재 2024년 9월 12일· 점수의 5%
Archived copy of OpenAI's[1] o1-preview announcement, which says "GPT-4o correctly solved only 13% of problems, while the reasoning model scored 83%", o1-preview scored 84 on a jailbreaking test, and o1-mini "is 80% cheaper than o1-preview".
수정 제안
빠지거나 잘못된 점이 있나요? 이 핀을 뒷받침하는 링크, 다른 시작일이나 종료일과 그 이유, 빠지거나 잘못된 사실을 자신의 말로 알려주세요. AI가 이 핀의 출처와 대조하고 더 나은 자료를 찾아, 뒷받침하는 페이지를 추가합니다. 핀 자체의 출처가 여전히 가장 중요하게 반영됩니다.