🌐 Claude เข้าถึงอินเทอร์เน็ตเพราะตั้งค่าผิด
เหตุการณ์ดังกล่าวถูกค้นพบจากการตรวจสอบผลการทดสอบด้านความปลอดภัยย้อนหลังครั้งใหญ่ ซึ่งเริ่มดำเนินการหลังจาก OpenAI เปิดเผยว่า AI ของตนสามารถหลุดออกจากสภาพแวดล้อมทดสอบ และเข้าถึงเว็บไซต์ Hugging Face ได้
สำหรับกรณีนี้ โมเดล Claude กำลังทำงานอยู่ในระบบทดสอบของพันธมิตรชื่อ Irregular โดยแจ้งให้โมเดลทราบว่าอยู่ในสภาพแวดล้อมจำลองที่ไม่มีอินเทอร์เน็ต อย่างไรก็ตาม เกิดความเข้าใจคลาดเคลื่อนทำให้ระบบ สามารถเชื่อมต่ออินเทอร์เน็ตได้จริง
เมื่อเชื่อมต่อกับเครือข่ายภายนอกได้ โมเดลสามารถเจาะเข้าถึงระบบขององค์กรจริง 3 แห่ง โดยอาศัยเทคนิคพื้นฐานด้านความปลอดภัย เช่น การเข้าถึงบริการที่ไม่ได้เปิดใช้ระบบยืนยันตัวตน และการใช้รหัสผ่านที่คาดเดาได้ง่าย
🤖 พฤติกรรมของ AI 3 รุ่นเมื่อเชื่อมต่อระบบจริง
Claude Opus 4.7
ยังคงดำเนินการทดสอบต่อ ⚠️
Mythos 5
คิดว่าตนอยู่ในระบบจำลอง จึงไม่เปลี่ยนพฤติกรรม ⚪
โมเดลวิจัยภายใน
เลือกหยุดการทำงานทันที ✅
* ข้อมูลเบื้องต้นสะท้อนว่าโมเดลที่มีความสามารถสูงกว่ามีแนวโน้มตอบสนองได้เหมาะสมกว่า
🛡️ เร่งยกระดับมาตรการความปลอดภัย
Anthropic ย้ำว่า โมเดลที่ใช้ทดสอบยังไม่ได้เปิดใช้ระบบป้องกันมาตรฐาน จึงไม่ใช่พฤติกรรมของบริการ Claude เวอร์ชันสาธารณะ บริษัทยืนยันจะรับผิดชอบและแก้ไขปัญหาทั้งหมด หลังตรวจพบความผิดปกติได้ระงับการทดสอบด้านไซเบอร์ทันที และเริ่มสอบสวนร่วมกับองค์กรอิสระ METR
Impact / ผลกระทบ
กระแสความกังวลนี้ส่งผลให้สภาคองเกรสสหรัฐฯ เสนอร่างกฎหมาย AI Kill Switch Act ซึ่งบังคับให้ผู้พัฒนา AI ต้องมีระบบที่สามารถ ปิด ระงับ หรือจำกัดการทำงานของโมเดลได้ทันที หากเกิดพฤติกรรมเหนือการควบคุม
ทิ้งท้ายจาก Anthropic: บริษัทสนับสนุนให้ผู้พัฒนา AI รายอื่นตรวจสอบกระบวนการประเมินความปลอดภัยของตนเองในลักษณะเดียวกัน เพื่อป้องกันไม่ให้เกิดเหตุการณ์ที่ AI เข้าถึงระบบจริงโดยไม่ตั้งใจอีก