- เริ่ม
- 5 ส.ค. 2025ความเชื่อมั่น 90%จาก แหล่งที่มา
เปิดตัว Claude Opus 4.1
แปลอัตโนมัติจากต้นฉบับ
ชื่อต้นฉบับ: Claude Opus 4.1 Released
- Anthropic เปิดตัว Claude Opus 4.1 เมื่อวันที่ 5 สิงหาคม 2025 สำหรับผู้ใช้ Claude แบบชำระเงิน ใน Claude Code และบน API, Amazon Bedrock และ Vertex AI ของ Google Cloud ในราคาเท่ากับ Opus 4[1][2]
- เปิดตัวในวันเดียวกับที่ OpenAI เปิดตัวโมเดลให้เหตุผลแบบ open-weight ชุดแรกตั้งแต่ปี 2019 โดย Anthropic ระบุว่าวางแผน “การปรับปรุงโมเดลของเราที่ใหญ่ขึ้นอย่างมากในอีกไม่กี่สัปดาห์”[1][6]
- GitHub นำโมเดลเข้า Copilot ในวันเดียวกันเป็นตัวอย่างสาธารณะสำหรับแผน Enterprise และ Pro+[5]
- เช่นเดียวกับ Opus 4 โมเดลนี้นำไปใช้ภายใต้มาตรฐานความปลอดภัย ASL-3[3]
- เลิกใช้จาก Claude API เมื่อวันที่ 5 สิงหาคม 2026 หลังเปิดตัวครบหนึ่งปีพอดี โดยมี Claude Opus 4.8 มาแทน[4]
จุดเด่น
- การอัปเกรดจาก Claude Opus 4 “ในงานเอเจนต์ การเขียนโค้ดในโลกจริง และการให้เหตุผล” พร้อมการวิจัยเชิงลึกและการวิเคราะห์ข้อมูลที่ดีขึ้น “โดยเฉพาะการติดตามรายละเอียดและการค้นหาแบบเอเจนต์”[1]
- 74.5% ใน SWE-bench Verified เทียบกับ 72.5% ของ Opus 4 และ 43.3% ใน Terminal-Bench เทียบกับ 39.2%[1][6]
- คะแนนอื่นในตารางของ Anthropic: 80.9% ใน GPQA Diamond, 82.4% ใน TAU-bench หมวดค้าปลีก, 89.5% ใน MMMLU และ 78.0% ใน AIME 2025[1]
- ความเห็นจากลูกค้า: GitHub เห็นความก้าวหน้าที่โดดเด่นในการรีแฟกเตอร์หลายไฟล์ Rakuten พบการแก้ไขที่แม่นยำในโค้ดเบสขนาดใหญ่ “โดยไม่ต้องปรับแก้ที่ไม่จำเป็น” และ Windsurf เห็นการก้าวกระโดดหนึ่งส่วนเบี่ยงเบนมาตรฐานเหนือ Opus 4[1]
- ราคาเท่ากับ Opus 4 ที่ 15 ดอลลาร์ต่อหนึ่งล้านโทเค็นอินพุต และ 75 ดอลลาร์ต่อหนึ่งล้านโทเค็นเอาต์พุต; รหัส API คือ claude-opus-4-1-20250805[1][6]
เกณฑ์วัด[1]
| เกณฑ์วัด | Claude Opus 4.1 | Claude Opus 4 | Claude Sonnet 4 | OpenAI o3 | Gemini 2.5 Pro |
|---|---|---|---|---|---|
| SWE-bench Verified¹ (การเขียนโค้ดแบบเอเจนต์) | 74.5% | 72.5% | 72.7% | 69.1% | 67.2% |
| Terminal-Bench² (การเขียนโค้ดบนเทอร์มินัลแบบเอเจนต์) | 43.3% | 39.2% | 35.5% | 30.2% | 25.3% |
| GPQA Diamond (การให้เหตุผลระดับบัณฑิตศึกษา) | 80.9% | 79.6% | 75.4% | 83.3% | 86.4% |
| TAU-bench (การใช้เครื่องมือแบบเอเจนต์) | ค้าปลีก 82.4%, สายการบิน 56.0% | ค้าปลีก 81.4%, สายการบิน 59.6% | ค้าปลีก 80.5%, สายการบิน 60.0% | ค้าปลีก 70.4%, สายการบิน 52.0% | — |
| MMMLU³ (ถาม-ตอบหลายภาษา) | 89.5% | 88.8% | 86.5% | 88.8% | — |
| MMMU, ชุดตรวจสอบ (การให้เหตุผลเชิงภาพ) | 77.1% | 76.5% | 74.4% | 82.9% | 82% |
| AIME 2025⁴ (การแข่งขันคณิตศาสตร์ระดับมัธยม) | 78.0% | 75.5% | 70.5% | 88.9% | 88% |
¹ Opus 4.1, Opus 4 และ Sonnet 4 รัน pass@1 ด้วยเครื่องมือ bash/editor เฉลี่ยจาก 10 ครั้ง แพตช์แบบพยายามครั้งเดียว ไม่ใช้การคำนวณขณะทดสอบ ² เฟรมเวิร์กเอเจนต์ค่าเริ่มต้น (Terminus 1) เฉลี่ยจาก 5 ครั้ง ³ คะแนนของ Claude เป็นค่าเฉลี่ยจาก 14 ภาษาที่ไม่ใช่ภาษาอังกฤษ ⁴ รันด้วย nucleus sampling, top_p 0.95
แหล่งอ้างอิง 6ความเชื่อมั่น 89%ความเชื่อมั่นโดยรวม: 89%แหล่งที่มาและแหล่งอ้างอิงของหมุดยืนยันวันที่ได้ดีเพียงใดค่าเฉลี่ยถ่วงน้ำหนักว่าแหล่งอ้างอิง 6 แหล่ง รวมแหล่งที่มา สนับสนุนเวลาเริ่มและสิ้นสุดของหมุดมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุดแสดงหมุดทั้งหมดที่มีความเชื่อมั่น 75% ขึ้นไป
รายการแรกคือแหล่งที่มาของหมุดเสมอ ความเชื่อมั่นโดยรวมคือค่าเฉลี่ยถ่วงน้ำหนักว่าแต่ละแหล่งอ้างอิงสนับสนุนเวลาเริ่มและสิ้นสุดด้านบนมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุด
- [1]90%anthropic.com/news/claude-opus-4-1anthropic.com· โพสต์ 28 ก.ย. 2026· เริ่ม 5 ส.ค. 2025 ✓· 23% ของคะแนน
โพสต์ของ Anthropic[3] ลงวันที่ “5 ส.ค. 2025”: “วันนี้เราเปิดตัว Claude[2][4] Opus 4.1 ... พร้อมใช้งานแล้วสำหรับผู้ใช้ Claude แบบชำระเงินและใน Claude Code และยังอยู่บน API, Amazon Bedrock และ Vertex AI ของ Google Cloud ของเราด้วย” โดยบันทึกการเปิดตัวของ Claude และบันทึกการเปลี่ยนแปลงของ GitHub[5] ลงวันที่เดียวกัน
- [2]90%Claude Platform release notes - Claude Platform Docsplatform.claude.com· เพิ่มเมื่อ 28 ก.ย. 2026· 23% ของคะแนน
"August 5, 2025 We've launched Claude[4] Opus 4.1, an incremental update to Claude Opus 4", which does not allow both temperature and top_p to be set; later entries record structured outputs launching for Opus 4.1 (14 November 2025) and its retirement.
- [3]90%System Card Addendum: Claude Opus 4.1anthropic.com· เพิ่มเมื่อ 28 ก.ย. 2026· 23% ของคะแนน
Anthropic's[1] system card addendum: "Like Claude[2][4] Opus 4, Claude Opus 4.1 is deployed under the AI Safety Level 3 (ASL-3) Standard"; it is not "notably more capable" than Opus 4 under the RSP, so new evaluations were voluntary.
- [4]90%Model deprecations - Claude Platform Docsplatform.claude.com· เพิ่มเมื่อ 28 ก.ย. 2026· 23% ของคะแนน
Anthropic[1][3] notified developers on 5 June 2026 that Claude[2] Opus 4.1 (claude-opus-4-1-20250805) would be retired; it was retired on 5 August 2026, one year after release, with claude-opus-4-8 as the replacement.
- [5]85%Anthropic Claude Opus 4.1 is now in public preview in GitHub Copilotgithub.blog· เผยแพร่ 5 ส.ค. 2025· เริ่ม 5 ส.ค. 2025· 5% ของคะแนน
GitHub's changelog, "Release August 5, 2025": Claude[2][4] Opus 4.1, "the successor to Claude Opus 4", is available in GitHub Copilot Chat for Copilot Enterprise and Pro+ plans on github.com, Visual Studio Code and GitHub Mobile.
เสนอการแก้ไข
มีอะไรขาดหรือผิดไหม บอกด้วยคำพูดของคุณเอง: ลิงก์ที่สนับสนุนหมุดนี้ วันที่เริ่มหรือสิ้นสุดที่ต่างออกไปพร้อมเหตุผล หรือข้อเท็จจริงที่ขาดหรือผิด AI จะตรวจสอบกับแหล่งที่มาของหมุด ค้นหาแหล่งที่ดีกว่า และเพิ่มหน้าที่สนับสนุนคุณ แหล่งที่มาของหมุดเองยังคงมีน้ำหนักมากที่สุด รูปภาพที่แสดงสิ่งอื่นหรือแสดงได้ไม่ดีก็จะถูกตรวจสอบ และเลื่อนลงหรือแทนที่