- เริ่ม
- 12 ก.ย. 2024ความเชื่อมั่น 95%จาก help.openai.com
OpenAI o1-preview และ o1-mini เปิดตัว
แปลอัตโนมัติจากต้นฉบับ
ชื่อต้นฉบับ: OpenAI o1-preview and o1-mini Released
- OpenAI เปิดตัว o1-preview และ o1-mini เมื่อ 12 กันยายน 2024 โดยมีขีดจำกัดข้อความรายสัปดาห์ใน ChatGPT ที่ 30 และ 50 ข้อความตามลำดับ[1]
- OpenAI เผยแพร่ system card ของโมเดลเหล่านี้เมื่อ 12 กันยายน[2]
- พอดแคสต์เดือนตุลาคม 2024 อธิบายการให้เหตุผลแบบ chain-of-thought ของ o1 จุดแข็งในงานเขียนโค้ดที่ซับซ้อน การทดสอบความปลอดภัยแบบเทียบกับ GPT-4o โดยตรง และการประเมิน jailbreaking การหลอนข้อมูล การหลอกลวง และการโน้มน้าว โดยใช้เพียงคำอธิบายตอนรายการ ไม่ใช่ถอดเสียง[2]
- OpenAI ใช้ GPT-4o กำกับพฤติกรรมของ o1 และทำการทดสอบความเป็นอิสระและ red-team ด้านความมั่นคงปลอดภัยไซเบอร์และข้อมูลเท็จ ตามคำอธิบายของพอดแคสต์[2]
ฟีเจอร์เด่น
- โมเดลให้เหตุผลชุดใหม่ชุดแรกที่ฝึกให้ใช้เวลาคิดแก้ปัญหามากขึ้นก่อนตอบ โดยเรียนรู้ที่จะปรับปรุงการคิด ลองกลยุทธ์ที่ต่างกัน และรู้ตัวเมื่อผิดพลาด OpenAI รีเซ็ตตัวนับกลับเป็น 1 และตั้งชื่อชุดนี้ว่า OpenAI o1[3]
- ในการทดสอบของ OpenAI โมเดลอัปเดตรุ่นถัดไปที่กำลังพัฒนาอยู่ในขณะนั้นได้ 83% ในข้อสอบคัดเลือกโอลิมปิกคณิตศาสตร์ระหว่างประเทศ เทียบกับ 13% ของ GPT-4o และไปถึงเปอร์เซ็นไทล์ที่ 89 ในการแข่งขัน Codeforces[3]
- แนวทางฝึกด้านความปลอดภัยแบบใหม่ให้โมเดลให้เหตุผลเกี่ยวกับกฎความปลอดภัยตามบริบท ในหนึ่งในการทดสอบ jailbreaking ที่ยากที่สุดของ OpenAI o1-preview ได้ 84 จาก 100 เทียบกับ 22 ของ GPT-4o[3]
- o1-mini เป็นโมเดลให้เหตุผลที่เร็วกว่าและถูกกว่า มีประสิทธิภาพสูงเป็นพิเศษในการเขียนโค้ด ถูกกว่า o1-preview 80%[3]
- ตอนเปิดตัว โมเดลเหล่านี้ยังไม่มีการท่องเว็บและการอัปโหลดไฟล์และภาพใน ChatGPT และ API ยังไม่มีการเรียกใช้ฟังก์ชัน การสตรีม และข้อความระบบ โดยนักพัฒนาในระดับการใช้งาน tier 5 เข้าถึง API ได้ที่ 20 คำขอต่อนาที[3]
แหล่งอ้างอิง 3ความเชื่อมั่น 93%ความเชื่อมั่นโดยรวม: 93%แหล่งที่มาและแหล่งอ้างอิงของหมุดยืนยันวันที่ได้ดีเพียงใดค่าเฉลี่ยถ่วงน้ำหนักว่าแหล่งอ้างอิง 3 แหล่ง รวมแหล่งที่มา สนับสนุนเวลาเริ่มและสิ้นสุดของหมุดมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุดแสดงหมุดทั้งหมดที่มีความเชื่อมั่น 75% ขึ้นไป
รายการแรกคือแหล่งที่มาของหมุดเสมอ ความเชื่อมั่นโดยรวมคือค่าเฉลี่ยถ่วงน้ำหนักว่าแต่ละแหล่งอ้างอิงสนับสนุนเวลาเริ่มและสิ้นสุดด้านบนมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุด
- [1]95%OpenAI Model Release Notes: Introducing OpenAI o1-preview and o1-mini (September 12, 2024)help.openai.com· โพสต์ 19 ก.ย. 2026· เริ่ม 12 ก.ย. 2024· 89% ของคะแนน
บันทึกการเปิดตัวโมเดลของ OpenAI เองระบุวันที่ของรายการนี้เป็น 12 กันยายน 2024
- [2]70%AIandBlockchain: AI's Quantum Leap Unpacking OpenAI's O1 Modelspodcasts.apple.com· เผยแพร่ 7 ต.ค. 2024· 6% ของคะแนน
AIandBlockchain's episode "AI's Quantum Leap Unpacking OpenAI's[1] O1 Models" (2024-10-07) says: "a bit unsettling. Join us as we break down the key elements of OpenAI's O1 models, using excerpts from their recently released system card ( September 12th ). We’ll discuss the unique strengths of the O1 Preview and O1 Mini models, highlighting their enhanced ability to handle complex coding tasks, while also"
- [3]88%Introducing OpenAI o1-preview | OpenAI (Wayback Machine copy)web.archive.org· เผยแพร่ 12 ก.ย. 2024· 5% ของคะแนน
Archived copy of OpenAI's[1] o1-preview announcement, which says "GPT-4o correctly solved only 13% of problems, while the reasoning model scored 83%", o1-preview scored 84 on a jailbreaking test, and o1-mini "is 80% cheaper than o1-preview".
เสนอการแก้ไข
มีอะไรขาดหรือผิดไหม บอกด้วยคำพูดของคุณเอง: ลิงก์ที่สนับสนุนหมุดนี้ วันที่เริ่มหรือสิ้นสุดที่ต่างออกไปพร้อมเหตุผล หรือข้อเท็จจริงที่ขาดหรือผิด AI จะตรวจสอบกับแหล่งที่มาของหมุด ค้นหาแหล่งที่ดีกว่า และเพิ่มหน้าที่สนับสนุนคุณ แหล่งที่มาของหมุดเองยังคงมีน้ำหนักมากที่สุด รูปภาพที่แสดงสิ่งอื่นหรือแสดงได้ไม่ดีก็จะถูกตรวจสอบ และเลื่อนลงหรือแทนที่