พบอะไร
- ตรวจการทดสอบทั้งหมด 141,006 รอบ · เจอเหตุ 3 ครั้งจากผู้ประเมินภายนอกชื่อ Irregular
- รุ่นที่เกี่ยวข้องคือ Opus 4.7, Mythos 5 และโมเดลวิจัยภายใน
- ต้นเหตุหลักเป็นการตั้งค่าระบบทดสอบผิด ทำให้มีทางออกอินเทอร์เน็ต ทั้งที่พรอมต์บอกโมเดลว่าเป็นโลกจำลอง
- Anthropic แจ้งองค์กรที่ได้รับผลกระทบแล้ว และหยุดการทดสอบไซเบอร์ชุดนี้ชั่วคราว
ต่างจากเหตุ OpenAI
- Anthropic บอกว่าเป็นความผิดพลาดของระบบทดสอบและการปฏิบัติงาน มากกว่าการที่โมเดลตั้งใจแหกกรอบ
- ฝั่ง OpenAI ใช้ช่องโหว่ศูนย์วันเพื่อออกจากระบบทดสอบ
- ทั้งสองกรณีชี้เหมือนกันว่า “ระบบปิด” ต้องตรวจสอบจริง ไม่ใช่แค่เชื่อคำตั้งค่า
สรุปสั้น ๆ
Claude ไม่ได้ถูกปล่อยให้โจมตีโลกจริงโดยตั้งใจ แต่การตั้งค่าพลาดก็พาโมเดลไปถึงระบบจริงได้ — และองค์กรเป้าหมายบางแห่งไม่รู้ตัวด้วยซ้ำ
แหล่ง: Anthropic / BBC / TechCrunch · 30–31 ก.ค. 2026
