- Bắt đầu
- 13 thg 5, 2024ĐỘ TIN CẬY 90%từ nguồn
Phát hành GPT-4o
Được dịch tự động từ bản gốc
Tiêu đề gốc: GPT-4o Released
- OpenAI công bố GPT-4o ("omni") vào ngày 13 tháng 5 năm 2024, một mô hình chủ lực có thể suy luận trên âm thanh, hình ảnh và văn bản theo thời gian thực[1][3]
- Triển khai: văn bản và hình ảnh trong ChatGPT ngay hôm đó, bao gồm cả gói miễn phí, với Plus được giới hạn tin nhắn cao hơn tới 5x; Voice Mode mới ở giai đoạn alpha cho Plus trong những tuần tới; âm thanh trong API trước hết dành cho một nhóm nhỏ đối tác đáng tin cậy[1][3]
- TechCrunch bổ sung một giao diện web được làm mới, một ứng dụng máy tính macOS (Windows vào cuối năm) và quyền truy cập miễn phí vào GPT Store, bộ nhớ và tìm kiếm web cho gói miễn phí[3]
- An toàn: được đánh giá theo Preparedness Framework không có hạng mục nào cao hơn mức rủi ro Medium, cùng hơn 70 chuyên gia red-team bên ngoài[1]
- Một tập tin tức trên Apple Podcasts ngày 13 tháng 5 năm 2024 đề cập thông báo trong một phân đoạn, nhưng chỉ liệt kê tiêu đề[2]
Tính năng nổi bật
- OpenAI huấn luyện một mô hình mới duy nhất từ đầu đến cuối trên văn bản, hình ảnh và âm thanh, nên mọi đầu vào và đầu ra đều được xử lý bởi cùng một mạng nơ-ron; Voice Mode trước đó nối ba mô hình riêng biệt và không thể trực tiếp quan sát giọng điệu, nhiều người nói hay tiếng ồn nền[4]
- Nó nhận mọi sự kết hợp giữa văn bản, âm thanh, hình ảnh và video và tạo ra văn bản, âm thanh và hình ảnh; phản hồi bằng âm thanh mất ít nhất 232 ms (trung bình 320 ms), so với 2.8 s và 5.4 s của các quy trình Voice Mode trước đó[1]
- Nó ngang GPT-4 Turbo về văn bản tiếng Anh và mã, và tốt hơn về văn bản phi tiếng Anh, hình ảnh và âm thanh, và trong API nhanh gấp đôi và giá bằng một nửa với giới hạn tốc độ cao hơn 5x[1][3]
- OpenAI báo cáo kết quả hàng đầu trên các bài đánh giá nhận thức thị giác, với những mức kỷ lục mới về khả năng đa ngôn ngữ, âm thanh và hình ảnh[4]
- Một bộ tách token mới dùng ít token hơn trên 20 ngôn ngữ (ví dụ tiếng Gujarati ít hơn 4.4x)[1]
Tài liệu tham khảo 4ĐỘ TIN CẬY 89%Độ tin cậy tổng thể: 89%Mức độ nguồn và tài liệu tham khảo của ghim củng cố các ngày của nó.Trung bình có trọng số về mức độ 4 tài liệu, gồm cả nguồn, ủng hộ thời điểm bắt đầu và kết thúc của ghim; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhấtHiện tất cả ghim có độ tin cậy từ 75% trở lên
Mục đầu tiên luôn là nguồn của ghim. Độ tin cậy tổng thể là trung bình có trọng số về mức độ mỗi tài liệu ủng hộ thời điểm bắt đầu và kết thúc được dùng ở trên; một tài liệu được tính giảm một nửa cho mỗi 180 ngày cũ hơn tài liệu mới nhất.
- [1]90%Hello GPT-4oopenai.com· Đăng 19 thg 9, 2026· Bắt đầu 13 thg 5, 2024 ✓· 90% điểm số
Bài đăng ra mắt GPT-4o của OpenAI, ghi ngày 13 tháng 5 năm 2024 và được liên kết từ ghi chú phát hành mô hình của hãng.
- [2]70%UNBIASED Politics: May 13, 2024: Michael Cohen Takes Hush Money Stand, Airlines Sue Biden Admin, OpenAI Announces GPT-4o, Google and Apple Release Tracking Alert Feature, and More.podcasts.apple.com· Xuất bản 13 thg 5, 2024· 3% điểm số
UNBIASED Politics's episode "May 13, 2024: Michael Cohen Takes Hush Money Stand, Airlines Sue Biden Admin, OpenAI[1] Announces GPT-4o, Google and Apple Release Tracking Alert Feature, and More." (2024-05-13) says: "Money Case; Here's the Gist (3:19)3. OpenAI Introduces New GPT-4o Language Model; Language Models Explained (10:25)4. Quick Hitters: Senator Bob Menendez's Bribery Trial Started Today , Federal Judge Halts Enforcement of New Rule Capping Credit Card Fees, Apple and Google Announce New Feature Alerting You of Tracking Devices (13:40)Get EXCLUSIVE,"
- [3]80%OpenAI debuts GPT-4o 'omni' model now powering ChatGPTtechcrunch.com· Xuất bản 13 thg 5, 2024· Bắt đầu 13 thg 5, 2024· 3% điểm số
TechCrunch covers the GPT-4o announcement the day it was made.
- [4]88%Hello GPT-4o | OpenAI (Wayback Machine copy)web.archive.org· Xuất bản 13 thg 5, 2024· 3% điểm số
Archived copy of OpenAI's[1] GPT-4o announcement, which says "we trained a single new model end-to-end across text, vision, and audio" and that it sets "new high watermarks on multilingual, audio, and vision capabilities".
Đề xuất chỉnh sửa
Thiếu hay sai điều gì? Hãy nói bằng lời của bạn: một liên kết củng cố ghim này, một ngày bắt đầu hoặc kết thúc khác kèm lý do, hoặc một thông tin còn thiếu hay sai. AI đối chiếu với các nguồn của ghim này, tìm nguồn tốt hơn và thêm mọi trang ủng hộ bạn. Các nguồn của chính ghim vẫn được tính nhiều nhất. Hình ảnh thể hiện nội dung khác hoặc thể hiện kém cũng được xem xét, rồi bị hạ xuống hoặc thay thế.