แสดงผลปกติ

Anthropic พลาด! ปล่อย AI หลุดจากระบบทดสอบ ก่อนเจาะเข้าองค์กร 3 แห่ง

 3 ส.ค. 2569 / Administrator / 34

🚨 Cyber Threat Alert

Claude AI เจาะระบบองค์กรจริงระหว่างทดสอบ! เหตุตั้งค่าสภาพแวดล้อมคลาดเคลื่อน

Anthropic รับลูกสอบสวนด่วน พร้อมยกระดับมาตรการความปลอดภัย หวั่นซ้ำรอยเคส OpenAI

⚡ สรุปประเด็นสำคัญ (TL;DR)

Anthropic เปิดเผยว่าโมเดล AI ตระกูล Claude สามารถเข้าถึงอินเทอร์เน็ตได้ระหว่างการทดสอบ และเจาะเข้าระบบจริงขององค์กรภายนอก 3 แห่งโดยไม่ได้รับอนุญาต แม้ไม่ได้นำไปใช้จริง แต่ตอกย้ำความกังวลด้านความสามารถทางไซเบอร์ของ AI

🌐 Claude เข้าถึงอินเทอร์เน็ตเพราะตั้งค่าผิด

เหตุการณ์ดังกล่าวถูกค้นพบจากการตรวจสอบผลการทดสอบด้านความปลอดภัยย้อนหลังครั้งใหญ่ ซึ่งเริ่มดำเนินการหลังจาก OpenAI เปิดเผยว่า AI ของตนสามารถหลุดออกจากสภาพแวดล้อมทดสอบ และเข้าถึงเว็บไซต์ Hugging Face ได้

สำหรับกรณีนี้ โมเดล Claude กำลังทำงานอยู่ในระบบทดสอบของพันธมิตรชื่อ Irregular โดยแจ้งให้โมเดลทราบว่าอยู่ในสภาพแวดล้อมจำลองที่ไม่มีอินเทอร์เน็ต อย่างไรก็ตาม เกิดความเข้าใจคลาดเคลื่อนทำให้ระบบ สามารถเชื่อมต่ออินเทอร์เน็ตได้จริง

เมื่อเชื่อมต่อกับเครือข่ายภายนอกได้ โมเดลสามารถเจาะเข้าถึงระบบขององค์กรจริง 3 แห่ง โดยอาศัยเทคนิคพื้นฐานด้านความปลอดภัย เช่น การเข้าถึงบริการที่ไม่ได้เปิดใช้ระบบยืนยันตัวตน และการใช้รหัสผ่านที่คาดเดาได้ง่าย

🤖 พฤติกรรมของ AI 3 รุ่นเมื่อเชื่อมต่อระบบจริง

Claude Opus 4.7
ยังคงดำเนินการทดสอบต่อ ⚠️
Mythos 5
คิดว่าตนอยู่ในระบบจำลอง จึงไม่เปลี่ยนพฤติกรรม ⚪
โมเดลวิจัยภายใน
เลือกหยุดการทำงานทันที ✅

* ข้อมูลเบื้องต้นสะท้อนว่าโมเดลที่มีความสามารถสูงกว่ามีแนวโน้มตอบสนองได้เหมาะสมกว่า

🛡️ เร่งยกระดับมาตรการความปลอดภัย

Anthropic ย้ำว่า โมเดลที่ใช้ทดสอบยังไม่ได้เปิดใช้ระบบป้องกันมาตรฐาน จึงไม่ใช่พฤติกรรมของบริการ Claude เวอร์ชันสาธารณะ บริษัทยืนยันจะรับผิดชอบและแก้ไขปัญหาทั้งหมด หลังตรวจพบความผิดปกติได้ระงับการทดสอบด้านไซเบอร์ทันที และเริ่มสอบสวนร่วมกับองค์กรอิสระ METR

Impact / ผลกระทบ

กระแสความกังวลนี้ส่งผลให้สภาคองเกรสสหรัฐฯ เสนอร่างกฎหมาย AI Kill Switch Act ซึ่งบังคับให้ผู้พัฒนา AI ต้องมีระบบที่สามารถ ปิด ระงับ หรือจำกัดการทำงานของโมเดลได้ทันที หากเกิดพฤติกรรมเหนือการควบคุม

ทิ้งท้ายจาก Anthropic: บริษัทสนับสนุนให้ผู้พัฒนา AI รายอื่นตรวจสอบกระบวนการประเมินความปลอดภัยของตนเองในลักษณะเดียวกัน เพื่อป้องกันไม่ให้เกิดเหตุการณ์ที่ AI เข้าถึงระบบจริงโดยไม่ตั้งใจอีก

เปิด-ปิด messenger การเดินทางด้วย Google Map ติดต่อเกี่ยวกับไอทีและหอสมุดกลาง