- เริ่ม
- 28 ก.ย. 2026ความเชื่อมั่น 90%จาก แหล่งที่มา
เปิดตัว Claude Sonnet 5.5
แปลอัตโนมัติจากต้นฉบับ
ชื่อต้นฉบับ: Claude Sonnet 5.5 Released
- Anthropic เปิดตัว Claude Sonnet 5.5 “โมเดลตัวที่สองในตระกูล Claude 5.5” เมื่อวันที่ 28 กันยายน 2026 หกวันหลัง Claude Opus 5.5 โดยเป็น “การอัปเกรดที่ชัดเจนจาก Claude Sonnet 5 ทำงานเร็วกว่า 30% ขึ้นไป และราคาถูกลงสูงสุด 30% สำหรับงานส่วนใหญ่”[1][2][3]
- Anthropic วางตำแหน่งให้เป็นคู่หูที่เร็วกว่าและถูกกว่าของ Opus 5.5 โดยเก่งที่สุดใน “งานประจำวันที่ขอบเขตชัดเจน การแก้บั๊ก และการสร้างเอกสาร สไลด์ และสเปรดชีตที่ประณีต” ส่วน CNBC เรียกว่าเป็นการเปิดตัวครั้งที่สองของ Anthropic นับตั้งแต่ Dario Amodei เรียกร้องให้ห้องปฏิบัติการชะลอความก้าวหน้าระดับแนวหน้า[1][3]
- ความสามารถด้านไซเบอร์เทียบเท่า Opus 5 จึงเป็น Sonnet รุ่นแรกที่เปิดตัวพร้อมมาตรการป้องกันและระบบสำรองด้านไซเบอร์ - งานความมั่นคงปลอดภัยไซเบอร์ที่เสี่ยงสูงกว่า “จะถอยกลับไปใช้ Sonnet 5 อย่างเห็นได้ชัด” - และเป็นรุ่นแรกที่มีตัวจำแนกที่บล็อกการดึงเหตุผลโดยผู้โจมตีแบบ distillation[1][2]
- พร้อมใช้งานในวันเดียวกันบน Claude Platform ในชื่อ
claude-sonnet-5-5และบน Amazon Web Services, Google Cloud และ Microsoft Azure โดยไม่เก็บข้อมูลเลย และใน GitHub Copilot[1][4][6] - Claude Haiku 5.5 “สร้างมาสำหรับแอปพลิเคชันปริมาณมากและเน้นต้นทุน จะเข้าร่วมตระกูล Claude 5.5 ในอีกไม่กี่สัปดาห์”[1][2]
จุดเด่น
- ราคายังคงเท่า Sonnet 5 คือ 2 ดอลลาร์ต่อหนึ่งล้านโทเค็นอินพุต และ 10 ดอลลาร์ต่อหนึ่งล้านโทเค็นเอาต์พุต โดยการอ่านแคช 0.20 ดอลลาร์ และการเขียนแคช 2.50 ดอลลาร์ แต่ใช้โทเค็นต่องานน้อยลงมาก เอาต์พุตสร้างเร็วขึ้นกว่า 30% “โมเดล Sonnet ที่เร็วที่สุดของเราจนถึงปัจจุบัน”[1][4]
- ข้อมูลจำเพาะ: หน้าต่างบริบท 1M โทเค็น เอาต์พุตสูงสุด 128K (300K บน Batch API แบบเบต้า) adaptive thinking โดยระดับความพยายามค่าเริ่มต้นคือ High บนแพลตฟอร์มและ Medium ในแอป Claude รับอินพุตข้อความและรูปภาพ และข้อมูลความรู้ที่เชื่อถือได้ถึงเดือนมิถุนายน 2026[1][4]
- ผลเกณฑ์วัดที่ Anthropic รายงาน: Terminal-Bench 4.0 70.6% เทียบกับ 10.3% ของ Sonnet 5 และ 66.4% ของ Opus 5.5; GDPval-AA v2.1 1844 เทียบกับ 1449 และ 1846; OSWorld 2.1 80.1% เทียบกับ 57.0% และ 81.8%; CursorBench 4.0 55.5%[1]
- เป็น Sonnet รุ่นแรกที่เอาชนะ Pokémon Red ได้โดยใช้ภาพหน้าจอเท่านั้น และ Anthropic ระบุว่าในการทดสอบของบริษัท Opus 5.5 “ยังคงเหนือกว่าอย่างชัดเจนในงานที่ซับซ้อนและปลายเปิดซึ่งต้องใช้วิจารณญาณอย่างต่อเนื่อง”[1]
- มีลายน้ำข้อความที่มองไม่เห็นของ Anthropic ซึ่งเพิ่มเข้ามาเพื่อให้เป็นไปตามกฎเช่น EU AI Act[5]
เกณฑ์วัด[1]
| เกณฑ์วัด | Sonnet 5.5 | Sonnet 5 | Opus 5.5 | GPT-6 Sol |
|---|---|---|---|---|
| Terminal-Bench 4.0 (การเขียนโค้ดแบบเอเจนต์) | 70.6% | 10.3% | 66.4%¹ | — |
| FrontierCode 1.1 (หลัก) (การเขียนโค้ดแบบเอเจนต์) | 46.2% (Max²), 52.1% (Xhigh) | 42.4% | 54.4% | 49.3% |
| CursorBench 4.0 (การเขียนโค้ดแบบเอเจนต์) | 55.5% | 34.1% | 57.8% | — |
| GDPval-AA v2.1³ (งานความรู้) | 1844 | 1449 | 1846 | 1487⁴ |
| AA-Briefcase v1.1³ (งานความรู้) | 1811 | 1359 | 1822 | 1483⁴ |
| Humanity's Last Exam (การให้เหตุผลหลายสาขาวิชา) | 64.5% พร้อมเครื่องมือ | 54.9% พร้อมเครื่องมือ | 67.7% พร้อมเครื่องมือ | — |
| OSWorld 2.1 (การใช้คอมพิวเตอร์) | 80.1% บางส่วน | 57.0% บางส่วน | 81.8% บางส่วน | — |
| Chartography (การรู้จำแผนภูมิจากภาพ) | 61.6% ไม่ใช้เครื่องมือ | 15.6% ไม่ใช้เครื่องมือ | 64.4% ไม่ใช้เครื่องมือ | 53.6%⁴ ไม่ใช้เครื่องมือ |
¹ Opus 5.5 ที่ความพยายามระดับ Xhigh ซึ่งเป็นคะแนนสูงสุดของโมเดล ² Sonnet 5.5 ได้คะแนนต่ำกว่าที่ความพยายามระดับ Max เมื่อเทียบกับ Xhigh ใน FrontierCode ซึ่งลงโทษการเปลี่ยนแปลงนอกขอบเขต ³ รันโดย Artificial Analysis บนการติดตั้งก่อนเปิดตัวของ Sonnet 5.5 ซึ่งมีบั๊กเอาต์พุตแบบมีโครงสร้างที่แก้ไขแล้ว ⁴ คะแนนของ GPT-6 Sol อาจเป็นก่อนที่ OpenAI จะแก้บั๊กที่ทำให้ความเข้าใจภาพลดลง
แหล่งอ้างอิง 6ความเชื่อมั่น 86%ความเชื่อมั่นโดยรวม: 86%แหล่งที่มาและแหล่งอ้างอิงของหมุดยืนยันวันที่ได้ดีเพียงใดค่าเฉลี่ยถ่วงน้ำหนักว่าแหล่งอ้างอิง 6 แหล่ง รวมแหล่งที่มา สนับสนุนเวลาเริ่มและสิ้นสุดของหมุดมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุดแสดงหมุดทั้งหมดที่มีความเชื่อมั่น 75% ขึ้นไป
รายการแรกคือแหล่งที่มาของหมุดเสมอ ความเชื่อมั่นโดยรวมคือค่าเฉลี่ยถ่วงน้ำหนักว่าแต่ละแหล่งอ้างอิงสนับสนุนเวลาเริ่มและสิ้นสุดด้านบนมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุด
- [1]90%anthropic.com/claude-sonnet-5-5anthropic.com· โพสต์ 28 ก.ย. 2026· เริ่ม 28 ก.ย. 2026 ✓· 17% ของคะแนน
ประกาศของ Anthropic มีหัวเรื่องว่า “Claude[4] Sonnet 5.5 28 กันยายน 2026” และระบุว่า “พร้อมใช้งานแล้วบนทุกแพลตฟอร์ม” หน้าโมเดลระบุ “เปิดตัว 28 กันยายน 2026” และ TechCrunch[2] (11:00 น. ตามเวลา PDT 28 กันยายน 2026) กับ CNBC[3] (“Anthropic เปิดตัวเมื่อวันจันทร์”) ให้ข้อมูลตรงกัน
- [2]90%Anthropic releases Sonnet 5.5, which it calls a significantly cheaper, faster work partner | TechCrunchtechcrunch.com· เผยแพร่ 28 ก.ย. 2026· เริ่ม 28 ก.ย. 2026· 17% ของคะแนน
TechCrunch's same-day report by Lucas Ropek (11:00 AM PDT, September 28, 2026): Anthropic[1] "has released the newest version of Sonnet", about three months after Sonnet 5, with the same cyber safeguards as Fable and Opus, and a new Haiku "in the coming weeks" with no firm date.
- [3]85%Anthropic launches cheaper AI model, its second release since CEO's call for a slowdowncnbc.com· เผยแพร่ 28 ก.ย. 2026· เริ่ม 28 ก.ย. 2026· 17% ของคะแนน
CNBC: "Anthropic[1] on Monday released a new AI model called Sonnet 5.5", its second launch since Dario Amodei urged labs to slow frontier progress, at $2 and $10 per million tokens, "half the price of Opus 5.5", with Haiku 5.5 "coming soon".
- [4]90%Claude Sonnet 5.5 - Claude Platform Docsplatform.claude.com· เผยแพร่ 28 ก.ย. 2026· 17% ของคะแนน
Anthropic's[1] model page: claude-sonnet-5-5, 1M-token context, 128K max output (300K on the Batch API in beta), adaptive thinking with high default effort, text and images in, a June 2026 knowledge cutoff, cache writes $2.50 and reads $0.20 per million tokens, and five breaking changes from Sonnet 5.
- [5]80%Anthropic debuts Claude Sonnet 5.5 running 30% faster than the previous-generation AI model - SiliconANGLEsiliconangle.com· เผยแพร่ 28 ก.ย. 2026· เริ่ม 28 ก.ย. 2026· 17% ของคะแนน
SiliconANGLE's same-day report adds that Sonnet 5.5 carries Anthropic's[1] invisible text watermarking, added to comply with rules including the EU AI Act, and that Haiku 5.5 is planned "in the coming weeks".
เสนอการแก้ไข
มีอะไรขาดหรือผิดไหม บอกด้วยคำพูดของคุณเอง: ลิงก์ที่สนับสนุนหมุดนี้ วันที่เริ่มหรือสิ้นสุดที่ต่างออกไปพร้อมเหตุผล หรือข้อเท็จจริงที่ขาดหรือผิด AI จะตรวจสอบกับแหล่งที่มาของหมุด ค้นหาแหล่งที่ดีกว่า และเพิ่มหน้าที่สนับสนุนคุณ แหล่งที่มาของหมุดเองยังคงมีน้ำหนักมากที่สุด รูปภาพที่แสดงสิ่งอื่นหรือแสดงได้ไม่ดีก็จะถูกตรวจสอบ และเลื่อนลงหรือแทนที่