- เริ่ม
- 19 พ.ค. 2026ความเชื่อมั่น 95%จาก deepmind.google
เปิดตัว Gemini 3.5 Flash
แปลอัตโนมัติจากต้นฉบับ
ชื่อต้นฉบับ: Gemini 3.5 Flash Released
- Google เปิดตัว Gemini 3.5 Flash เมื่อวันที่ 19 พฤษภาคม 2026 ในงาน Google I/O ซึ่งระบุว่าเป็นโมเดลที่แข็งแกร่งที่สุดสำหรับการเขียนโค้ดและเอเจนต์อัตโนมัติ[1]
- Koray Kavukcuoglu กล่าวว่า "เหนือกว่าโมเดลแนวหน้าล่าสุดของเรา 3.1 Pro ในเกือบทุกเกณฑ์วัด" และเร็วกว่าโมเดลแนวหน้าอื่น 4 เท่า โดยเวอร์ชันที่ปรับให้เหมาะสมเร็วกว่า 12 เท่าที่คุณภาพเดียวกัน[1]
- พัฒนาร่วมกับ Google Antigravity และในการสาธิต เอเจนต์ถูกสร้างขึ้นเพื่อสร้างระบบปฏิบัติการทั้งระบบตั้งแต่ศูนย์ Google ปล่อย Antigravity 2.0 แอปเดสก์ท็อปแบบสแตนด์อโลนในวันเดียวกัน[1]
- Google ระบุว่า 3.5 Pro ที่กำลังจะมา จะทำหน้าที่ "ผู้ประสานงาน" โดยมี Flash เป็นเอเจนต์ย่อย และ 3.5 มีมาตรการป้องกันด้านไซเบอร์และ CBRN ที่เข้มแข็งขึ้น[1]
คุณสมบัติเด่น
- Terminal-bench 2.1 76.2% (3 Flash 58.0%), SWE-Bench Pro 55.1% และ OSWorld-Verified 78.4% สำหรับการใช้คอมพิวเตอร์[3]
- MCP Atlas 83.6%, GDPval-AA 1656 Elo สำหรับงานความรู้, CharXiv Reasoning 84.2% และ ARC-AGI-2 72.1%[3]
- ทำงานอัตโนมัติได้หลายชั่วโมง โดยหยุดถามข้อมูลเพิ่มเติมที่จุดตัดสินใจ[1]
เกณฑ์วัด[3]
| เกณฑ์วัด | Gemini 3.5 Flash | Gemini 3 Flash | Gemini 3.1 Pro | Claude Sonnet 4.6 | Claude Opus 4.7 | GPT-5.5 |
|---|---|---|---|---|---|---|
| Terminal-bench 2.1 (การเขียนโค้ดผ่านเทอร์มินัลแบบเอเจนต์ ชุดควบคุม Terminus-2) | 76.2% | 58.0% | 70.3% | — | 66.1% | 78.2% |
| SWE-Bench Pro (Public) (งานเขียนโค้ดแบบเอเจนต์หลากหลาย พยายามครั้งเดียว) | 55.1% | 49.6% | 54.2% | — | 64.3% | 58.6% |
| MCP Atlas (เวิร์กโฟลว์หลายขั้นตอนด้วย MCP) | 83.6% | 62.0% | 78.2% | 69.5% | 79.1% | 75.3% |
| Toolathlon (การใช้เครื่องมือทั่วไปในโลกจริง) | 56.5% | 49.4% | — | — | — | 55.6% |
| OSWorld-Verified (การใช้คอมพิวเตอร์แบบเอเจนต์) | 78.4% | 65.1% | 76.2% | 72.5% | 78.0% | 78.7% |
| Finance Agent v2 (การวิเคราะห์การเงินและการตัดสินใจ) | 57.9% | 42.6% | 43.0% | 51.0% | 51.5% | 51.8% |
| GDPval-AA (งานความรู้ที่มีคุณค่าทางเศรษฐกิจ, Elo) | 1656 | 1204 | 1314 | 1676 | 1753 | 1769 |
| CharXiv Reasoning (การสังเคราะห์ข้อมูลจากแผนภูมิที่ซับซ้อน ไม่ใช้เครื่องมือ) | 84.2% | 80.3% | 83.3% | 72.4% | 82.1% | 84.1% |
| MMMU-Pro (ความเข้าใจและการให้เหตุผลแบบมัลติโมดัล ไม่ใช้เครื่องมือ) | 83.6% | 81.2% | 80.5% | 74.5% | 75.2% | 81.2% |
| Blueprint-Bench 2 (การให้เหตุผลเชิงพื้นที่แบบเอเจนต์ คะแนนปรับมาตรฐาน) | 33.6% | 0.0% | 26.5% | 6.7% | 24.5% | 36.2% |
| MRCR v2 (8-needle) (ประสิทธิภาพบริบทยาว 128k (ค่าเฉลี่ย)) | 77.3% | 67.2% | 84.9% | 84.9% | 59.3% | 94.8% |
| MRCR v2 (8-needle) (ประสิทธิภาพบริบทยาว 1M (รายจุด)) | 26.6% | 22.1% | 26.3% | — | — | — |
| Humanity’s Last Exam (การให้เหตุผลทางวิชาการ (ชุดเต็ม ข้อความ + MM)) | 40.2% | 33.7% | 44.4% | 33.2% | 46.9% | 41.4% |
| ARC-AGI-2 (ปริศนาการให้เหตุผลเชิงนามธรรม) | 72.1% | 33.6% | 77.1% | 58.3% | 75.8% | 84.6% |
แหล่งอ้างอิง 3ความเชื่อมั่น 85%ความเชื่อมั่นโดยรวม: 85%แหล่งที่มาและแหล่งอ้างอิงของหมุดยืนยันวันที่ได้ดีเพียงใดค่าเฉลี่ยถ่วงน้ำหนักว่าแหล่งอ้างอิง 3 แหล่ง รวมแหล่งที่มา สนับสนุนเวลาเริ่มและสิ้นสุดของหมุดมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุดแสดงหมุดทั้งหมดที่มีความเชื่อมั่น 75% ขึ้นไป
รายการแรกคือแหล่งที่มาของหมุดเสมอ ความเชื่อมั่นโดยรวมคือค่าเฉลี่ยถ่วงน้ำหนักว่าแต่ละแหล่งอ้างอิงสนับสนุนเวลาเริ่มและสิ้นสุดด้านบนมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุด
- [1]90%techcrunch.com/2026/05/19/with-gemini-3-5-flash-google-bets-its-next-ai-wave-on-agents-not-chatbotstechcrunch.com· โพสต์ 30 ก.ย. 2026· เริ่ม 19 พ.ค. 2026· 39% ของคะแนน
TechCrunch รายงานว่า Google เปิดตัว Gemini 3.5 Flash เมื่อวันอังคารที่ 19 พฤษภาคม 2026 ในงานประชุมนักพัฒนา I/O ประจำปี และ model card ของ 3.5 Flash จาก Google DeepMind[3] เผยแพร่ในวันเดียวกัน
- [2]75%Gemini (language model) - Wikipediaen.wikipedia.org· เพิ่มเมื่อ 30 ก.ย. 2026· 39% ของคะแนน
The Wikipedia article lists Gemini 3.5 Flash as released on 19 May 2026, based on Gemini 3 Flash.
- [3]95%Gemini 3.5 Flash - Model Carddeepmind.google· เผยแพร่ 19 พ.ค. 2026· เริ่ม 19 พ.ค. 2026 ✓· 23% ของคะแนน
DeepMind's model card, published 19 May 2026, gives the benchmark results against Gemini 3 Flash, 3.1 Pro, Claude Sonnet 4.6, Claude Opus 4.7 and GPT-5.5.
เสนอการแก้ไข
มีอะไรขาดหรือผิดไหม บอกด้วยคำพูดของคุณเอง: ลิงก์ที่สนับสนุนหมุดนี้ วันที่เริ่มหรือสิ้นสุดที่ต่างออกไปพร้อมเหตุผล หรือข้อเท็จจริงที่ขาดหรือผิด AI จะตรวจสอบกับแหล่งที่มาของหมุด ค้นหาแหล่งที่ดีกว่า และเพิ่มหน้าที่สนับสนุนคุณ แหล่งที่มาของหมุดเองยังคงมีน้ำหนักมากที่สุด รูปภาพที่แสดงสิ่งอื่นหรือแสดงได้ไม่ดีก็จะถูกตรวจสอบ และเลื่อนลงหรือแทนที่