- البدء
- 12 سبتمبر 2024ثقة 95%من help.openai.com
إطلاق OpenAI o1-preview وo1-mini
تُرجم تلقائيًا من الأصل
العنوان الأصلي: OpenAI o1-preview and o1-mini Released
- أطلقت OpenAI نموذجَي o1-preview وo1-mini في 12 سبتمبر 2024، بحدود أسبوعية لرسائل ChatGPT قدرها 30 و50 على التوالي[1]
- نشرت OpenAI في 12 سبتمبر بطاقة النظام الخاصة بالنموذجين[2]
- يصف بودكاست من أكتوبر 2024 سلسلة الاستدلال المتسلسلة في o1 وتفوقه في البرمجة المعقدة واختبارات السلامة المباشرة مقابل GPT-4o وتقييمات كسر الحماية والهلوسة والخداع والإقناع؛ وهو يعتمد على وصف الحلقة فقط لا على نص مفرّغ[2]
- استخدمت OpenAI نموذج GPT-4o لمراقبة سلوك o1، وأجرت اختبارات استقلالية واختبارات هجومية في الأمن السيبراني والمعلومات المضللة، بحسب وصف البودكاست[2]
أبرز الميزات
- أولى سلسلة جديدة من نماذج الاستدلال المدرَّبة على قضاء وقت أطول في التفكير في المسائل قبل الرد، وهي تتعلم تحسين تفكيرها وتجربة استراتيجيات مختلفة والتعرف على الأخطاء؛ وأعادت OpenAI العدّاد إلى 1 وسمّت السلسلة OpenAI o1[3]
- في اختبارات OpenAI حقق التحديث التالي للنموذج، وكان قيد التطوير حينها، 83% في اختبار تأهيلي لأولمبياد الرياضيات الدولي مقابل 13% لـ GPT-4o، وبلغ المئين 89 في مسابقات Codeforces[3]
- يعتمد أسلوب تدريب جديد على السلامة يجعل النموذج يستدل على قواعد السلامة ضمن السياق؛ وفي أحد أصعب اختبارات كسر الحماية لدى OpenAI سجّل o1-preview 84 من 100 مقابل 22 لـ GPT-4o[3]
- o1-mini نموذج استدلال أسرع وأرخص وفعّال بوجه خاص في البرمجة، وأرخص بنسبة 80% من o1-preview[3]
- عند الإطلاق افتقر النموذجان في ChatGPT إلى التصفح ورفع الملفات والصور، وافتقرت واجهة API إلى استدعاء الدوال والبث ورسائل النظام، مع إتاحة API لمطوري الفئة 5 بمعدل 20 طلبًا في الدقيقة[3]
المراجع 3ثقة 93%الثقة الإجمالية: 93%مدى دعم مصدر الدبوس ومراجعه لتواريخه.متوسط مرجّح لمدى قوة دعم 3 مراجع، بما فيها المصدر، لوقتَي بدء الدبوس وانتهائه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجععرض كل الدبابيس بثقة 75% أو أعلى
المدخل الأول هو دائمًا مصدر الدبوس. الثقة الإجمالية متوسط مرجّح لمدى قوة دعم كل مرجع لوقتَي البدء والانتهاء المستخدمين أعلاه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجع.
- [1]95%OpenAI Model Release Notes: Introducing OpenAI o1-preview and o1-mini (September 12, 2024)help.openai.com· نُشر 19 سبتمبر 2026· يبدأ 12 سبتمبر 2024· 89% من الدرجة
تؤرخ ملاحظات إصدار النماذج لدى OpenAI هذا البند في 12 سبتمبر 2024
- [2]70%AIandBlockchain: AI's Quantum Leap Unpacking OpenAI's O1 Modelspodcasts.apple.com· صدر 7 أكتوبر 2024· 6% من الدرجة
AIandBlockchain's episode "AI's Quantum Leap Unpacking OpenAI's[1] O1 Models" (2024-10-07) says: "a bit unsettling. Join us as we break down the key elements of OpenAI's O1 models, using excerpts from their recently released system card ( September 12th ). We’ll discuss the unique strengths of the O1 Preview and O1 Mini models, highlighting their enhanced ability to handle complex coding tasks, while also"
- [3]88%Introducing OpenAI o1-preview | OpenAI (Wayback Machine copy)web.archive.org· صدر 12 سبتمبر 2024· 5% من الدرجة
Archived copy of OpenAI's[1] o1-preview announcement, which says "GPT-4o correctly solved only 13% of problems, while the reasoning model scored 83%", o1-preview scored 84 on a jailbreaking test, and o1-mini "is 80% cheaper than o1-preview".
اقتراح تصحيح
هل ينقص شيء أو يوجد خطأ؟ قله بكلماتك: رابط يدعم هذا الدبوس، أو تاريخ بدء أو انتهاء مختلف مع السبب، أو معلومة ينقصها أو يخطئ فيها. يفحص الذكاء الاصطناعي ذلك بمقارنته بمصادر هذا الدبوس، ويبحث عن مصادر أفضل، ويضيف أي صفحة تدعم كلامك. وتبقى مصادر الدبوس نفسه الأثقل وزنًا. كما تُفحص الصورة التي تُظهر شيئًا آخر أو تُظهره بشكل سيئ، فتُنزَّل أو تُستبدل.