- เริ่ม
- 13 พ.ค. 2024ความเชื่อมั่น 90%จาก แหล่งที่มา
GPT-4o เปิดตัว
แปลอัตโนมัติจากต้นฉบับ
ชื่อต้นฉบับ: GPT-4o Released
- OpenAI ประกาศ GPT-4o ("omni") เมื่อ 13 พฤษภาคม 2024 โมเดลเรือธงที่ให้เหตุผลข้ามเสียง ภาพ และข้อความได้แบบเรียลไทม์[1][3]
- การทยอยเปิดใช้: ข้อความและภาพใน ChatGPT ในวันนั้น รวมถึงระดับใช้ฟรี โดย Plus ได้ขีดจำกัดข้อความสูงขึ้นถึง 5 เท่า Voice Mode ใหม่ในรุ่นอัลฟาสำหรับ Plus ในอีกไม่กี่สัปดาห์ข้างหน้า และเสียงใน API เปิดให้พาร์ตเนอร์ที่ไว้ใจได้กลุ่มเล็กก่อน[1][3]
- TechCrunch เพิ่มเติมว่ามีเว็บ UI ที่ปรับใหม่ แอปเดสก์ท็อป macOS (Windows ตามมาภายหลังในปีนี้) และผู้ใช้ฟรีเข้าถึง GPT Store หน่วยความจำ และการค้นหาเว็บได้[3]
- ความปลอดภัย: ประเมินภายใต้ Preparedness Framework โดยไม่มีหมวดใดเกินความเสี่ยงระดับ Medium และมีผู้เชี่ยวชาญ red-team ภายนอกกว่า 70 คน[1]
- ตอนข่าวของ Apple Podcasts วันที่ 13 พฤษภาคม 2024 กล่าวถึงการประกาศนี้ในช่วงหนึ่งของรายการ แต่ระบุเพียงหัวข้อ[2]
ฟีเจอร์เด่น
- OpenAI ฝึกโมเดลใหม่ตัวเดียวแบบครบวงจรทั้งข้อความ ภาพ และเสียง ทำให้อินพุตและเอาต์พุตทั้งหมดถูกประมวลผลด้วยโครงข่ายประสาทเทียมเดียวกัน ส่วน Voice Mode เดิมต่อโมเดลสามตัวแยกกันและไม่สามารถสังเกตน้ำเสียง ผู้พูดหลายคน หรือเสียงรบกวนพื้นหลังได้โดยตรง[4]
- รับอินพุตเป็นการผสมกันของข้อความ เสียง ภาพ และวิดีโอ และสร้างข้อความ เสียง และภาพ การตอบด้วยเสียงใช้เวลาเพียง 232 มิลลิวินาที (เฉลี่ย 320 มิลลิวินาที) เทียบกับ 2.8 วินาทีและ 5.4 วินาทีของไปป์ไลน์ Voice Mode เดิม[1]
- เทียบเท่า GPT-4 Turbo ในข้อความภาษาอังกฤษและโค้ด และดีกว่าในข้อความที่ไม่ใช่ภาษาอังกฤษ การมองเห็น และเสียง และใน API เร็วเป็นสองเท่า ราคาครึ่งเดียว และมีขีดจำกัดอัตราสูงกว่า 5 เท่า[1][3]
- OpenAI รายงานผลระดับสูงสุดในเกณฑ์วัดการรับรู้ภาพ พร้อมสถิติสูงสุดใหม่ด้านความสามารถหลายภาษา เสียง และการมองเห็น[4]
- โทเคนไนเซอร์ใหม่ใช้โทเคนน้อยลงใน 20 ภาษา (เช่น ภาษาคุชราตน้อยลง 4.4 เท่า)[1]
แหล่งอ้างอิง 4ความเชื่อมั่น 89%ความเชื่อมั่นโดยรวม: 89%แหล่งที่มาและแหล่งอ้างอิงของหมุดยืนยันวันที่ได้ดีเพียงใดค่าเฉลี่ยถ่วงน้ำหนักว่าแหล่งอ้างอิง 4 แหล่ง รวมแหล่งที่มา สนับสนุนเวลาเริ่มและสิ้นสุดของหมุดมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุดแสดงหมุดทั้งหมดที่มีความเชื่อมั่น 75% ขึ้นไป
รายการแรกคือแหล่งที่มาของหมุดเสมอ ความเชื่อมั่นโดยรวมคือค่าเฉลี่ยถ่วงน้ำหนักว่าแต่ละแหล่งอ้างอิงสนับสนุนเวลาเริ่มและสิ้นสุดด้านบนมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุด
- [1]90%Hello GPT-4oopenai.com· โพสต์ 19 ก.ย. 2026· เริ่ม 13 พ.ค. 2024 ✓· 90% ของคะแนน
โพสต์เปิดตัว GPT-4o ของ OpenAI ลงวันที่ 13 พฤษภาคม 2024 และลิงก์จากบันทึกการเปิดตัวโมเดล
- [2]70%UNBIASED Politics: May 13, 2024: Michael Cohen Takes Hush Money Stand, Airlines Sue Biden Admin, OpenAI Announces GPT-4o, Google and Apple Release Tracking Alert Feature, and More.podcasts.apple.com· เผยแพร่ 13 พ.ค. 2024· 3% ของคะแนน
UNBIASED Politics's episode "May 13, 2024: Michael Cohen Takes Hush Money Stand, Airlines Sue Biden Admin, OpenAI[1] Announces GPT-4o, Google and Apple Release Tracking Alert Feature, and More." (2024-05-13) says: "Money Case; Here's the Gist (3:19)3. OpenAI Introduces New GPT-4o Language Model; Language Models Explained (10:25)4. Quick Hitters: Senator Bob Menendez's Bribery Trial Started Today , Federal Judge Halts Enforcement of New Rule Capping Credit Card Fees, Apple and Google Announce New Feature Alerting You of Tracking Devices (13:40)Get EXCLUSIVE,"
- [3]80%OpenAI debuts GPT-4o 'omni' model now powering ChatGPTtechcrunch.com· เผยแพร่ 13 พ.ค. 2024· เริ่ม 13 พ.ค. 2024· 3% ของคะแนน
TechCrunch covers the GPT-4o announcement the day it was made.
- [4]88%Hello GPT-4o | OpenAI (Wayback Machine copy)web.archive.org· เผยแพร่ 13 พ.ค. 2024· 3% ของคะแนน
Archived copy of OpenAI's[1] GPT-4o announcement, which says "we trained a single new model end-to-end across text, vision, and audio" and that it sets "new high watermarks on multilingual, audio, and vision capabilities".
เสนอการแก้ไข
มีอะไรขาดหรือผิดไหม บอกด้วยคำพูดของคุณเอง: ลิงก์ที่สนับสนุนหมุดนี้ วันที่เริ่มหรือสิ้นสุดที่ต่างออกไปพร้อมเหตุผล หรือข้อเท็จจริงที่ขาดหรือผิด AI จะตรวจสอบกับแหล่งที่มาของหมุด ค้นหาแหล่งที่ดีกว่า และเพิ่มหน้าที่สนับสนุนคุณ แหล่งที่มาของหมุดเองยังคงมีน้ำหนักมากที่สุด รูปภาพที่แสดงสิ่งอื่นหรือแสดงได้ไม่ดีก็จะถูกตรวจสอบ และเลื่อนลงหรือแทนที่