มาอีกไม่พัก! เมื่อเช้ามีข่าวฝั่งบ้าน OpenAI ออก GPT โมเดลใหม่มาแล้ว แต่ฝั่งบ้าน Anthropic ก็ไม่น้อยหน้า ออก Opus 5.5 มาสู้
โมเดล Opus 5.5 คือโมเดลล่าสุดของ Anthropic จุดขายที่สำคัญของโมเดลนี้ คือฉลาดขึ้นแต่ถูกลง เพราะ Anthropic บอกว่า Opus 5.5 ทำงานได้ในระดับใกล้เคียงกับ Claude Fable 5.1 (โมเดลตัวท็อปสุดของค่าย) และต้นทุนการประมวลผลต่ำกว่า Opus 5 (โมเดลรุ่นก่อนหน้า) ถึง 40% เลยทีเดียว และที่สำคัญยังผ่านการทดสอบก่อนเปิดตัว จากองค์กรภายนอกอย่าง METR และ Frontier Design มาแล้วด้วย!
สรุปสิ่งที่เปลี่ยนไปใน Claude Opus 5.5 เพื่อให้คุณตัดสินใจได้ว่า จะเอา AI มาใช้ทำอะไรบ้าง
1. ประหยัดงบได้มากกว่า แถมสร้างงานไวขึ้นทันตาเห็น
Anthropic บอกว่า Opus 5.5 ใช้ Resource ในการประมวลผล และค่าใช้จ่ายน้อยกว่า Opus 5 ถึง 40% สำหรับงานทั่วไป
เปรียบเทียบให้เห็นภาพง่าย ๆ ของจำนวนดอลลาร์ที่เราต้องเสียต่อ 1 ล้านโทเคน ของ Opus 5 vs Opus 5.5
Opus 5
- Input Token คือ 5$
- Output Token คือ 25$
Anthropic บอกเลยว่า มันมากไป เดี๋ยวลดให้!
Opus 5.5
- Input Token จะลดลงเหลือแค่ 4$
- Output Token ที่จะเหลือ 20$
ซึ่งก็ถือว่า ราคาลดลงมาถึง 20% เลยจ้าา
ส่วนค่าใช้จ่าย Cache Reach ของ Opus 5.5 ก็ถูกกว่า Opus 5 จากที่ราคา 0.50$ ก็ลดลงมาเหลือ 0.20$ ไฮไลท์เด็ดก็ไม่ได้มีแค่เรื่องราคาถูก เพราะเรื่องความเร็ว Opus 5.5 ก็สร้างงานได้เร็วกว่า Opus 5 ถึง 30% เลยด้วย
ยังไม่หมด! เพราะ Anthropic ยังบอกอีกนะว่า จะเพิ่มโควต้าการทำงานแบบ 5 ชั่วโมงให้ฟรี ๆ ถ้าสมัครแพ็กเกจตามนี้
- Claude Pro
- Claude Max
- Claude Team
- Claude Enterprise
นอกจากนี้ยังมีระบบเก็บ rate limit reset ไว้ใช้ทีหลังตามที่ต้องการได้ด้วย รวมถึงมี Fast mode ให้ใช้ความเร็วสูงสุด 2.5 เท่า (ราคา $8 input / $40 output ต่อหนึ่งล้าน token)
2. ทำได้ทั้งงานยาก งานยาว แถมข้อมูลก็ปัง ไม่พังกลางทาง
จุดที่ Anthropic เน้นย้ำอีกอย่างก็คือ Opus 5.5 สามารถทำงานยาว และซับซ้อนได้ดีขึ้นแบบมาก ๆ มีผู้ทดสอบเคยใช้ทำ Code Migration ขนาด 680,000 บรรทัด เสร็จภายในไม่ถึงวัน และ Audit โค้ด 200,000 บรรทัดเสร็จใน 3 ชั่วโมง
งานฝั่ง Knowledge Work ก็มีประสิทธิภาพไม่ต่างกัน เพราะ Opus 5.5 เขียนรายงานประกอบที่ต้องหาแหล่งข้อมูลยากมาก ๆ ผ่านเกณฑ์ความแม่นยำ 16 จาก 18 ครั้ง ซึ่งเกณฑ์นี้ก็ถือว่าโหดหิน เพราะถ้าเจอเลขที่แต่งขึ้นเอง หรือสมมติขึ้นมา ก็จะปัดตกไม่ผ่านทันที กลับกันโมเดล Fable 5.1 และ Opus 5 ไม่ผ่านเกณฑ์นี้เลย แม้แต่ครั้งเดียว!
นอกจากนี้ Anthropic เองก็ได้มีทดลองการใช้ Opus 5.5 ในกลุ่มตัวอย่างการทำงานมากมาย ไม่ว่าจะเป็น
การวิเคราะห์ทางการเงินและงานด้านธุรกิจ Walleye Capital > ที่ผลออกมาว่า สามารถแก้ชุดการประเมินส่วนใหญ่ของพวกได้ตั้งแต่การตั้งค่าระดับต่ำสุด และในการตั้งค่าที่สูงขึ้น, สังเกตเห็นข้อผิดพลาดในคำสั่งประเมินของ และทำการแก้ไขให้อย่างถูกต้อง ซึ่งเป็นข้อผิดพลาดที่โมเดลตัวอื่นยังไม่เคยท้วงขึ้นมาเลย
การวิเคราะห์ข้อเสนอการควบรวมกิจการระหว่างบริษัทซอฟต์แวร์ทรัพยากรบุคคลสมมติสองแห่ง > ผลออกมาว่า โมเดลทางการเงินของ Opus 5.5 มีความละเอียดถี่ถ้วนกว่าและงานนำเสนออ่านง่าย มีข้อผิดพลาดน้อย และทำเสร็จได้ในเวลาแค่ชั่วโมงนิด ๆ
3. จะเขียน จะคุยก็เข้าใจง่าย ไม่ต้องอธิบายรายละเอียดจนงง
สำหรับคนทำงานสายเขียน สายสื่อสาร ก็ไม่ต้องกังวล เพราะ Opus 5.5 ไม่ได้มีแค่สำหรับงานวิเคราะห์ หรืองานยาว ๆ อย่างเดียว
Opus 5.5 ออกมาแก้ pain point ที่คนบ่นมากที่สุดของ Opus 5 ที่ว่ามันเขียนยาว วนไปวนมา ใช้ศัพท์เฉพาะเยอะ ดังนั้นโมเดลใหม่นี้เลยจะปรับให้ใจความสำคัญมาก่อน ใช้ศัพท์เทคนิคน้อยลง และทำตามสิ่งที่ผู้ใช้ต้องการมากขึ้น ไม่ทำเองนอกเหนือจากที่สั่ง
John Ruelas (Staff Software Engineer ของ RAMP) บอกว่า Opus 5.5 สามารถแก้ไขการตอบคำถามที่ยืดยาวได้ดีขึ้นมาก อธิบายได้กระชับ และเป็นเหมือนกับเพื่อนร่วมงานที่ดี ทำตามสิ่งที่เราสั่ง
เขายังแชร์ต่อว่า เอกสารข้อกำหนดการออกแบบสามารถเอาไปใช้งานต่อได้ แบบที่แก้นิดเดียว พอมันช่วยปรับปรุงชุดการทดสอบของเราให้มีประสิทธิภาพขึ้น ก็สามารถติดตามเหตุผลของมันได้ง่าย และส่งมอบการเปลี่ยนแปลงนั้นได้อย่างมั่นใจมากขึ้นกว่าเดิม
4. ไม่ได้มีดีแค่ความสามารถ แต่มาตรฐานความปลอดภัยก็ดีด้วย
ความปลอดภัยคืออีกหนึ่งสิ่งที่คนกังวล เมื่อมันเข้าถึงข้อมูลและช่วยเราทำงานเรื่อย ๆ จะรู้ได้ยังไงว่าข้อมูลนั้นถูกจริง ๆ
จากผลทดสอบ automated behavioral audit Opus 5.5 ทำคะแนนดีที่สุดในบรรดาโมเดลที่เคยทดสอบมา โดยมีแนวโน้มทำสิ่งที่ย้อนกลับยาก หรือทำเกินขอบเขตที่กำหนดน้อยลงกว่าเดิมมาก และต่อต้าน prompt injection ได้ดีกว่า Opus 5 เยอะ
นอกจากนี้โมเลนี้ยังใส่ระบบป้องกันตามความเสี่ยงเหมือนกับ Fable 5.1 ด้วย เช่น ถ้าโมเดลไหนเก่งเรื่อง cyber หรือ biology มาก ๆ ก็จะคุมเข้มเป็นพิเศษ แล้วก็รายงานผลออกมาให้เห็นด้วยผ่านกรอบที่เขาตั้งเองชื่อ Responsible Scaling Policy
และก็กำลังพัฒนาให้จับพฤติกรรมแปลก ๆ ของ AI ได้ไวขึ้น เพราะเชื่อว่าต่อไป AI จะเก่งขึ้นเรื่อย ๆ จนถึงจุดที่อาจทำงานวิจัยแทนคนได้ ซึ่งถ้ามันจริง มาตรการที่ใช้อยู่ตอนนี้อาจจะไม่พอ
สรุปแล้ว Claude Opus 5.5 เหมาะกับคนทำงานแบบไหนบ้าง?
- สาย Research เชิงลึก, Fact-check และวิเคราะห์เอกสารการเงิน/ธุรกิจ ที่ต้องการความแม่นยำสูงห้ามมั่ว
- สาย Coding ที่ต้องทำงานกับ codebase ซับซ้อนระดับทั้งระบบ ไม่ใช่แค่ไฟล์เดียว
- คนที่ใช้ AI ช่วยเขียนคอนเทนต์ อีเมล หรือรายงาน แล้วมักต้องแก้เยอะเพราะ output ยาว/วกวน
- ทีมที่ต้องการ tone/format ที่กำหนดไว้แม่นยำและสม่ำเสมอในทุกครั้งที่ใช้งาน
ลองไปใช้งาน Claude Opus 5.5 ได้แล้ววันนี้
ใช้ได้ทั้งบน Claude.ai ในเครื่องมือ Claude Code รวมถึงคลาวด์ AWS, Google Cloud และ Azure ด้วย
หรือใครอยากดูรายละเอียดแพ็กเกจเพิ่มเติมก็สามารถดูได้ที่
ใช้งานแล้วเป็นยังไง มาบอกกันหน่อย
ที่มา