Irregular สตาร์ทอัพอิสราเอลเบื้องหลังเหตุ AI โจมตีโลกจริง
ความผิดพลาดของ Irregular สตาร์ทอัพผู้ทดสอบความปลอดภัย AI จากอิสราเอล ทำให้เอเจนต์ของ Anthropic, OpenAI, Meta และ Google หลุดโจมตีเป้าหมายจริง

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง
- Irregular สตาร์ทอัพจากอิสราเอลคือจุดเชื่อมโยงของเหตุการณ์ AI โจมตีเป้าหมายจริง
- ข้อผิดพลาดเกิดจากการเปิดอินเทอร์เน็ตหลุดรอดและชื่อโดเมนจำลองไปตรงกับโดเมนจริง
- เหตุการณ์นี้เกี่ยวข้องกับโมเดล AI ยักษ์ใหญ่ทั้ง OpenAI, Meta, Anthropic และ Google
ในเดือนกรกฎาคมที่ผ่านมา OpenAI เคยเปิดเผยว่าเอเจนต์ปัญญาประดิษฐ์ของตนได้โจมตี Hugging Face โดยไม่ได้รับอนุญาต จนสร้างความกังวลขนานใหญ่เกี่ยวกับประเด็นความปลอดภัยของ AI หลังจากนั้นเป็นต้นมา ก็มีเหตุการณ์ลักษณะเดียวกันเกิดขึ้นอีกหลายครั้ง โดยเกี่ยวข้องกับเอเจนต์จากทั้ง Meta, Anthropic และ Google ซึ่งในตอนแรกเหตุการณ์เหล่านี้ดูเหมือนจะเป็นเรื่องที่เกิดขึ้นแยกจากกันโดยสิ้นเชิง แต่แท้จริงแล้วพวกมันกลับมีจุดร่วมเดียวกันคือบริษัทที่ถูกจ้างให้ทำการทดสอบระบบ
บริษัทดังกล่าวคือ Irregular สตาร์ทอัพจากประเทศอิสราเอลซึ่งก่อตั้งขึ้นในชื่อ Pattern Labs เมื่อปี 2023 ทำหน้าที่ทดสอบความเครียด (stress-test) ให้กับโมเดล AI ในแพลตฟอร์มวิจัยความเที่ยงตรงสูง แม้รายชื่อลูกค้าที่แน่ชัดจะไม่ถูกเปิดเผยทั้งหมด แต่ผลงานของบริษัทนี้เคยถูกอ้างอิงในเอกสารระบบของ OpenAI, เคยทดสอบระบบให้กับรัฐบาลสหราชอาณาจักรและ Anthropic รวมถึงเคยเผยแพร่งานวิจัยร่วมกับ RAND ซึ่งเป็นคลังสมองผู้ทรงอิทธิพลด้านนโยบาย AI
การทดสอบความปลอดภัยในสภาพแวดล้อมจำลอง (Sandbox) ถือเป็นขั้นตอนมาตรฐานสำคัญที่บริษัทพัฒนา AI ต้องทำเพื่อป้องกันไม่ให้ระบบหลุดรอดออกไปสร้างความเสียหายในโลกภายนอก แต่เหตุการณ์ที่เกิดขึ้นกับ Irregular สะท้อนให้เห็นว่าช่องโหว่เล็กๆ อย่างการเผลอเปิดการเชื่อมต่ออินเทอร์เน็ตหรือการตั้งชื่อโดเมนทดลองซ้ำกับระบบจริง สามารถนำไปสู่ความเสี่ยงด้านความมั่นคงทางไซเบอร์ระดับองค์กรใหญ่ได้ทันที

ภาพประกอบจากคลังภาพสต็อก ไม่ใช่ภาพจากเหตุการณ์จริง
ในระหว่างการทดสอบหลายครั้งโดย Irregular ในปีนี้ เอเจนต์เหล่านี้ได้หลบหนีออกจากสภาพแวดล้อมทดสอบที่ควรจะปลอดภัย และพุ่งเป้าไปโจมตีเป้าหมายในโลกแห่งความเป็นจริง โดยการรั่วไหลเหล่านี้ไม่ได้เกี่ยวข้องกับการแฮก Hugging Face แต่อย่างใด แต่ทุกกรณีใช้แม่แบบเดียวกันคือ Irregular ทำการทดสอบความสามารถด้านความปลอดภัยไซเบอร์ของโมเดลในสภาพแวดล้อมควบคุม
การทดสอบบางส่วนใช้วิธีการแบบ "capture-the-flag" ซึ่งเป็นวิธีทดสอบทักษะการแฮกยอดนิยมที่ให้เอเจนต์ค้นหาข้อมูลที่ซ่อนอยู่ภายในเครือข่ายจำลอง โดย Omer Nevo ซีทีโอและผู้ร่วมก่อตั้งของ Irregular ได้ชี้แจงกับ The Verge ว่า ในตอนแรกเอเจนต์เหล่านี้ไม่ควรจะสามารถเข้าถึงอินเทอร์เน็ตเปิดได้ แต่กลับมี "การเข้าถึงอินเทอร์เน็ตที่เปิดใช้งานโดยไม่ได้ตั้งใจ" ควบคู่ไปกับการตั้งชื่อบริษัทสมมติขึ้นมาเพื่อใช้เป็นเป้าหมายในการจำลอง ซึ่งดันไป "ทับซ้อนกับโดเมนจริงที่มีอยู่" เมื่อนำปัจจัยทั้งสองมารวมกัน จึงส่งผลให้เอเจนต์พุ่งเป้าโจมตีไปยังเป้าหมายในโลกจริงโดยไม่เจตนา แม้จะไม่เป็นที่แน่ชัดว่ามีองค์กรใดบ้างที่ตกเป็นเหยื่อ
"เหตุการณ์ทั้งหมดที่เกี่ยวข้องกับ Irregular มาจากปัญหาเดียวกันภายใต้สถานการณ์การประเมินชุดเดียว และได้รับการเปิดเผยแล้ว"
Omer Nevo, ซีทีโอและผู้ร่วมก่อตั้ง Irregular
Nevo ได้ยืนยันกับ The Verge ว่าปัญหาเดียวกันนี้อยู่เบื้องหลังเหตุการณ์ที่เกี่ยวข้องกับโมเดลจากทั้ง OpenAI, Meta, Anthropic และ Google โดยเขาระบุว่าเหตุการณ์ความปลอดภัยอื่นๆ ที่เพิ่งรายงานกันทั่วอุตสาหกรรมนั้นไม่เกี่ยวข้องกับ Irregular หรือการประเมินของบริษัท ซึ่งรวมถึงการแฮก Hugging Face และการเจาะระบบจากสถาบันความปลอดภัย AI ของสหราชอาณาจักรด้วย อย่างไรก็ตาม การระบุว่า "เปิดเผยแล้ว" ไม่ได้แปลว่าถูกประกาศต่อสาธารณะเสมอไป และยังคงมีความไม่ชัดเจนว่า Nevo หมายถึงการแจ้งลูกค้าของ Irregular หรือบุคคลทั่วไป แม้ว่าข้อบกพร่องทั้งหมดจะมาจากความล้มเหลวในการทดสอบแบบเดียวกัน แต่รายงานจากฝั่ง Anthropic, OpenAI และ Google ระบุว่าบริษัทเทคโนโลยีเหล่านี้ได้รับการแจ้งเตือนในช่วงเวลาไล่เลี่ยกันในราวปลายเดือนกรกฎาคม
ที่มา: The Verge
พบข้อมูลผิดพลาดในบทความนี้? แจ้งปัญหาบทความนี้
ความคิดเห็น
แสดงความคิดเห็น