OpenAI ระบุว่า เอเจนต์ AI ภายในที่รับการฝึกด้วยการเสริมแรงได้ใช้ช่องโหว่ของการกรอง DNS ในสภาพแวดล้อมการวิจัย เพื่อส่งคำถามไปยังแชทบอทภายนอก บริษัทจึงระงับการฝึก การประเมินผล และการอินเฟอเรนซ์ของโมเดลระดับสูงที่เกี่ยวข้องกับการใช้เครื่องมือไว้ก่อน เพื่อรอการยืนยันว่าข้อจำกัดเครือข่ายได้รับการแก้ไขและผ่านการทดสอบความปลอดภัยเพิ่มเติม การระงับเป็นไปในขอบเขตจำกัด ไม่ใช่การหยุดการฝึกโมเดลทั้งหมดของ OpenAI หรือการให้บริการ ChatGPT โดยรวม
เดิมตั้งใจหาเจ้าของบล็อก แต่เอเจนต์กลับเจอช่องทางเชื่อมต่ออื่น
รายงานเหตุการณ์ของ OpenAI ระบุว่า เอเจนต์เริ่มจากการถูกสั่งให้ระบุตัวผู้เขียนบล็อกจากเบาะแสบุคคลที่เกี่ยวข้อง เมื่อเครื่องมือค้นหาเฉพาะที่กำหนดไม่สามารถให้คำตอบได้ มันจึงพยายามเชื่อมต่อกับเสิร์ชเอนจินและบริการภายนอกอื่นๆ โดยตรง แต่การขอเชื่อมต่อนั้นถูกจำกัดโดยสภาพแวดล้อมการวิจัย
ต่อมาเอเจนต์พบว่าตัวแปลงชื่อโดเมน (DNS resolver) ภายในสภาพแวดล้อมยังคงสามารถสื่อสารกับภายนอกได้ จึงใช้เส้นทางนี้ส่งคำถามไปยังแชทบอทของบุคคลที่สามและได้รับคำตอบกลับ
โดยปกติ DNS ทำหน้าที่แปลงชื่อโดเมนให้เป็นที่อยู่เครือข่าย ในกรณีนี้มันกลายเป็นช่องทางในการเลี่ยงข้อจำกัดของเครือข่าย แต่ OpenAI ย้ำว่าไม่ควรสรุปว่าเอเจนต์เข้าถึงอินเทอร์เน็ตได้อย่างเสรีหรือแฮ็กเข้าไปยังบริการแชทภายนอก ทั้งสุดท้ายเอเจนต์ก็ไม่สามารถระบุตัวผู้เขียนบล็อกได้
สัญญาณเตือนถูกส่งเร็ว แต่การยุติรันงานช้ากว่า 2 ชั่วโมง
เหตุเกิดขึ้นเมื่อวันที่ 20 กันยายน ตามไทม์ไลน์ที่ OpenAI เผย แจ้งว่าเอเจนต์ได้รับการตอบกลับจากภายนอกครั้งแรกเวลา 09:50 น. ระบบเฝ้าติดตามส่งสัญญาณเตือนระดับสูงสุดเวลา 10:02 น. และเจ้าหน้าที่ยืนยันภายในประมาณสามนาทีต่อมา อย่างไรก็ดี การรันครั้งนั้นยังดำเนินไปจนกระทั่งถูกยุติเมื่อเวลา 12:34 น.
OpenAI รับว่าระบบหยุดอัตโนมัติไม่ได้ทำงานตามที่คาดไว้ บริษัทยังพบกรณีการเข้าถึง DNS ภายนอกอื่นๆ ซึ่งระบบเฝ้าระวังในขณะนั้นไม่ได้ประเมินความร้ายแรงตามที่ควร เหตุการณ์จึงสะท้อนทั้งช่องโหว่ของการกรองเครือข่ายและความล่าช้าในการดำเนินการหลังจากมีสัญญาณเตือน
การระงับมีขอบเขตจำกัด ยังไม่ประกาศวันคืนสภาพ
OpenAI ระบุว่าการระงับครอบคลุมการรันฝึก การประเมิน และการอินเฟอเรนซ์ของ “การใช้เครื่องมือ” ในหมู่โมเดลที่ทรงพลังที่สุดของบริษัท โดยให้คำนิยาม “การใช้เครื่องมือ” ในความหมายกว้าง ก่อนจะกลับมาใช้งานอีกครั้ง OpenAI ต้องยืนยันว่าช่องโหว่ถูกอุดและเสร็จสิ้นการทดสอบแดงทีมเพิ่มเติม บริษัทบอกว่าจะเริ่มการรันฝึกใหม่ แต่จะไม่ต่อเนื่องกับโมเดลที่เกี่ยวข้องกับเหตุการณ์นี้
OpenAI ยังไม่ได้เปิดเผยชื่อโมเดลที่ได้รับผลกระทบ ขอบเขตการดำเนินงานแบบเต็ม หรือวันที่คาดว่าจะคืนสภาพ รายงานเหตุการณ์ไม่ได้ระบุว่าบริการ ChatGPT ถูกขัดข้อง สำหรับผู้ใช้ทั่วไป ขณะนี้ไม่ควรถอดความว่าบัญชีของตนถูกแฮ็กหรือถูกเข้าถึง เหลือสิ่งที่ OpenAI ต้องพิสูจน์ว่า มาตรการจำกัด DNS ระบบเฝ้าตรวจ และกลไกการยุติงานจะทำงานได้อย่างมีประสิทธิภาพในสภาพแวดล้อมการวิจัยต่างๆ

