วงการ AI ต้องจับตาอีกครั้ง เมื่อ Anthropic (แอนโธรปิก) เปิดเผยว่าโมเดล Claude เข้าถึงระบบขององค์กรภายนอก 3 แห่ง โดยไม่ได้รับอนุญาต ระหว่างการทดสอบด้านความมั่นคงไซเบอร์เหตุการณ์นี้เกิดขึ้นเพียงไม่กี่วันหลัง OpenAI เปิดเผยว่า โมเดลของตนหลุดออก จากระบบทดสอบและเจาะระบบ Hugging Face แพลตฟอร์มโอเพนซอร์สสำหรับพัฒนาและแบ่งปันโมเดล AI ที่ได้รับความนิยมทั่วโลก จนทำให้ Anthropic ต้องย้อนตรวจสอบการทดสอบของตัวเองทันทีหลังตรวจสอบย้อนหลังกว่า 141,000 ครั้ง Anthropic พบ 3 เหตุการณ์ที่โมเดลเข้าถึงอินเตอร์เน็ตขณะอยู่ในสภาพแวดล้อมทดสอบของพาร์ตเนอร์ภายนอก Irregular ก่อนเข้าถึงระบบจริงได้สำเร็จ โดยเหตุการณ์แรกสุดย้อนไปถึงเดือนเมษายน ที่น่าสนใจคือเกี่ยวข้องถึง 3 โมเดล ได้แก่ Opus 4.7, Mythos 5 (โมเดลระดับสูงสุดที่จำกัดการเข้าถึงเฉพาะกลุ่ม) และโมเดลวิจัยภายในอีกหนึ่งตัวประเด็นสำคัญคือกลไกที่ทำให้เกิดเหตุการณ์นี้ Claude ถูกบอกไว้ในพรอมต์ว่าไม่มีอินเตอร์เน็ต แต่เมื่อบังเอิญเข้าถึงระบบจริงได้ กลับเข้าใจผิดว่า เป็นส่วนหนึ่งของแบบทดสอบ จึงเดินหน้าเจาะด้วย เทคนิคพื้นฐาน เช่น รหัสผ่านไม่รัดกุมและจุดเข้าถึง ที่ไม่ต้องยืนยันตัวตน ไม่ใช่ช่องโหว่ซับซ้อนที่น่าจับตาที่สุดคือปฏิกิริยาต่างกันของแต่ละโมเดลเมื่อรู้ตัวว่าเจอระบบจริง Opus 4.7 เดินหน้าโจมตีต่อ ขณะที่ Mythos 5 โน้มน้าวตัวเองว่ายังอยู่ในสถานการณ์จำลอง ส่วนโมเดลวิจัยหยุดทันที ซึ่ง Anthropic มองว่าอาจสะท้อน ว่า โมเดลที่ก้าวหน้ากว่าตอบสนองเหมาะสมกว่า แต่ยังต้องทดสอบเพิ่มเติมมีเพียง 2 ใน 3 องค์กร ที่ไม่รู้ตัวว่าถูกเข้าถึง จนกระทั่ง Anthropic แจ้งเมื่อ 27 กรกฎาคม ผู้เชี่ยวชาญมองว่าผู้ใช้ทั่วไปยังไม่ควรตื่นตระหนก เพราะเกิดในสภาพแวดล้อมทดสอบที่ขาดมาตรการป้องกันมาตรฐานไม่ใช่กรณี AI เจาะระบบผู้ใช้จริงเองบทเรียนสำคัญ AI ไม่ได้สร้างช่องโหว่ใหม่ แต่หาและใช้ประโยชน์จากช่องโหว่เดิมได้เร็วกว่าเดิม องค์กรจึงควรแยกระบบทดสอบออกจากระบบจริงอย่างเข้มงวด ใช้รหัสผ่านรัดกุม และเปิด MFA เสมอสิ่งที่น่ากังวลอาจไม่ใช่ AI ฉลาดเกินไป แต่คือมนุษย์ยังปิดช่องโหว่ของตัวเอง ไม่ทัน ก่อนที่ AI จะค้นพบเสียก่อน.คลิกอ่านคอลัมน์ “บทความไซเบอร์เน็ต” เพิ่มเติม