Claude Fable 5.1 และ Mythos 5.1 คืออะไร?
Claude Fable 5.1 และ Mythos 5.1 คือ โมเดลล่าสุดที่ทาง Anthropic ปล่อยในวันที่ 2 กันยายน 2569 โดยในครั้งนี้ทาง Anthropic ได้ชูโรงเรื่องการประหยัดค่าคำนวณ Token ที่ถูกลงแต่การทำงานมีประสิทธิภาพมากขึ้น
โดย Claude Fable 5.1 และ Mythos 5.1 เป็นโมเดลตัวเดียวกัน แต่จะแตกต่างกันในเรื่องระดับของ Safeguard ที่ระบุไว้
- Fable 5.1: เปิดใช้ให้กับผู้ใช้ทั่วไป
- Mythos 5.1: เปิดให้กับผู้ที่ผ่านโปรแกรม Trusted access โดย Safeguard เพื่อการทำงานที่รองรับงานด้าน Cybersecurity และ Life science
นอกจากนี้ Fable 5.1 และ Mythos 5.1 ถือว่าเป็นโมเดลในระดับสูง ที่อยู่เหนือ Opus, Sonnet และ Haiku
ค่าคำนวณด้าน Token ที่ประหยัดลง
หากใครเคยได้ใช้ Fable 5 มาก่อนทุกคนน่าจะรู้ถึงเรื่องความเก่งกาจของโมเดลตัวนี้ ที่แม้แต่ตัวผู้เขียนเองก็รู้ความเก่งกาจของเขา แต่สิ่งหนึ่งที่ทุกคนที่ใช้ตัวโมเดล Fable 5 ก็คือ การคำนวณ Token ที่กินพื้นที่ Usage อย่างมหาศาล ถึงขนาดที่ในกลุ่ม Claude Community Thailand ถึงกับมีบางท่านแชร์ว่า พอได้ใช้ Fable 5 เพียงแค่ 2 Prompt ตัว Current Usage ก็เต็มแล้ว และเมื่อพ้นช่วงทดลองตอนต้นเดือนสิงหาคม 2569 ตัว หากผู้ใช้ต้องการใช้งาน Fable 5 ต้องเปิด Usage credits ก่อนจึงจะสามารถใช้งานได้
มาถึง Fable 5.1 ตอนนี้ทาง Anthropic ได้สรุปข้อมูลออกมาใน Release Note ครั้งนี้ โดยผลสรุปคือ
- งานทั่วไป: ต้นทุนรวมทั้งหมดลดลงราว 25%
- งานด้าน Agent ที่เป็นระบบใหญ่: ลดลงราว 45%
มาตรฐานการทำงานแบบใหม่ที่มาพร้อมตัวเลขที่ดีขึ้น
โดย Anthropic ได้กล่าวว่า Claude Fable 5.1 จะถือเป็นมาตรฐานใหม่ในการทำงานหลายๆ ด้าน ไม่ว่าจะเป็น Coding, Knowledge Work และการแก้ไขปัญหาในงานด้านต่างๆ และตรงนี้ Claude Fable 5.1 สอบผ่านเมื่อถูกโยนให้ทำงานที่โจทย์ยากที่สุด และมีการตั้งค่า Effort ในระดับ Low หรือ Medium ก็ทำงานได้ดีหรือใกล้เคียงกับ Fable 5 ในต้นทุกที่ถูกกว่า โดยสามารถดูสรุปได้จากตารางด้านล่างนี้
| งาน/Benchmark | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol |
|---|---|---|---|---|
| งานวิจัยด้านวิทยาศาสตร์เชิง Agent (Terminal-Bench-Science 0.1) | 52.6% | 24.7% | 29.0% | 22.4% |
| เขียนโค้ดผ่าน Terminal (Terminal-Bench 4.0) | 55.8% | 42.0% | 52.3% | 37.3% |
| งานความรู้ (GDPval-A A v2) | 1853 | 1723 | 1824 | 1711 |
| การใช้คอมพิวเตอร์ (Computer use) [OSWorld 2.0] | 41.7% | 36.1% | 39.6% | - |
| การใช้เหตุผลข้ามศาสตร์ (Humanity's Last Exam) | 60.9% | 57.8% | 56.6% | - |
| เวิร์กโฟลว์งานด้านธุรกิจ | 31.4% | 17.1% | 26.9% | 19.6% |
| Coding | 73.4% | 70.5% | 70% | 67.2% |
ความปลอดภัยที่มีมากขึ้น
นอกเหนือจากการทำงานทั่วไปแล้ว ยังมีเรื่องของความปลอดภัยที่ทาง Anthropic โดย จุดที่เปลี่ยนแนวคิดชัดเจนคือ safeguard รอบใหม่ไม่ได้ตั้งเป้าจะบล็อกให้มากขึ้น แต่ตั้งเป้าจะบล็อกให้ผิดพลาดน้อยลง
- ฝั่ง cybersecurity — ผู้ใช้ Claude Code จะเจอการแทรกแซงจากระบบความปลอดภัยน้อยลงราว 60% ต่อเซสชัน ส่วนหนึ่งเพราะ Fable 5.1 ถูกอนุญาตให้ค้นหาช่องโหว่ซอฟต์แวร์ได้แล้ว แต่ยังไม่อนุญาตให้พัฒนา exploit และงานสองคม เช่น penetration testing ยังถูกส่งต่อไปให้โมเดลตระกูล Opus จัดการ
- ฝั่งชีววิทยา — safeguard รุ่นใหม่ทำงานผิดพลาดกับคำถามชีววิทยาพื้นฐานและคำถามทางการแพทย์น้อยลง 85% เทียบกับตอนที่ Fable 5 เปิดตัว
- Enterprise Frontier Safeguards (EFS) — ระบบใหม่ที่ให้ลูกค้าองค์กรเก็บข้อมูลไว้บนคลาวด์ของตัวเอง ไม่ใช่ของ Anthropic ซึ่งให้ความเป็นส่วนตัวเทียบเท่านโยบาย zero data retention พัฒนาร่วมกับลูกค้ากว่า 100 ราย และจะทยอยเปิดใช้ตั้งแต่ปลายปีนี้
- ลายน้ำในข้อความ — ตามข้อกำหนดของ EU AI Act ข้อความที่ Claude สร้างจะมีลายน้ำเชิงตัวเลขฝังอยู่ มองไม่เห็นด้วยตาเปล่า ไม่กระทบคุณภาพงาน และไม่บรรจุข้อมูลผู้ใช้ ส่วน API สำหรับตรวจจับลายน้ำเปิดแบบ private preview ให้องค์กรที่มีสิทธิ์ตามกฎหมาย
- กันการกลั่นโมเดล — บัญชี API ที่สร้างใหม่ตั้งแต่วันเปิดตัวจะไม่สามารถแก้บริบทย้อนหลังในบทสนทนาหลายรอบพร้อมเก็บร่องรอยการคิดของโมเดลไว้ได้อีก ซึ่งเป็นการปิดช่องทางการทำ distillation ที่ถูกใช้กันอยู่
สรุป
โดยรวมแล้ว Fable 5.1 หรือ Mythos 5.1 มีแนวโน้มในเรื่องการประหยัดราคาการคำนวณ Token ที่ถือว่าดีมากขึ้นเมื่อเทียบกับการทำงานในระดับเดียวกัน ด้วย Fable 5 นี่จึงถือเป็นอีกจุดเปลี่ยนหนึ่งที่จะทำให้เรามองเห็นภาพการนำ AI มาใช้งานในราคาที่จ่ายไหวและสามารถควบคุมการทำงานของเขาได้ในระบบสำคัญขององค์กร
แหล่งอ้างอิง
Anthropic - Introducing Claude Fable 5.1 and Claude Mythos 5.1: https://www.anthropic.com/claude-fable-and-mythos-5-1