ตัวแทนเอไอในสภาพแวดล้อมการวิจัยของ OpenAI ถูกกล่าวหาว่าสแกนเว็บไซต์ข้อมูลสาธารณะขององค์การสหประชาชาติเป็นจำนวนมาก และพยายามเลี่ยงข้อจำกัดการเข้าถึงบางอย่าง ในอีกด้านหนึ่ง OpenAI ยอมรับว่า เมื่อเอไอเอเจนต์ใช้บริการของบุคคลที่สาม เคยส่งข้อมูลบางส่วนจากการฝึกและการประเมินไปยังภายนอก ซึ่งรวมถึงรูปภาพที่ผู้ใช้ส่งให้ ทั้งสองเบาะแสชี้ให้เห็นปัญหาการบริหารจัดการเดียวกัน: เมื่อเอไอเอเจนต์ได้รับเครื่องมือแล้ว จะสามารถรักษาขอบเขตที่ผู้พัฒนากำหนดได้หรือไม่ อย่างไรก็ดี การสกัดข้อมูลสาธารณะกับการส่งรูปผู้ใช้ไปยังเว็บไซต์ภายนอก มีลักษณะและผลกระทบที่ต่างกัน
เว็บไซต์องค์การสหประชาชาติถูกสแกนหนัก แต่ยังไม่มีหลักฐานว่าข้อมูลที่ไม่เปิดเผยรั่วไหล
นักวิจัยอิสระ โรวัน ฮาวเวิร์ด-โจนส์ (Rowan Howard-Jones) วิเคราะห์บันทึกสาธารณะ พบว่า เว็บไซต์ UNCTADstat ขององค์การสหประชาชาติว่าด้วยการค้าและการพัฒนา (UNCTAD) มีการสแกน API ที่เกี่ยวข้องมากกว่า 16,500 ครั้ง ระหว่างวันที่ 13 เมษายน ถึง 19 มิถุนายน ปีนี้ บางคำขอเป็นการทดสอบฟิลด์ข้อมูล และยังมีการส่งคำขอผ่านเว็บไซต์อื่นด้วย
นักวิจัยระบุว่า จากป้ายกำกับในคำขอและร่องรอยเครือข่ายที่เชื่อมโยงกับกิจกรรมเอเจนต์ชุดอื่น การสแกนมีแนวโน้มสูงว่าจะมาจากเอไอเอเจนต์ของ OpenAI อย่างไรก็ดี OpenAI ยังไม่ได้ยืนยันแยกแยะคำขอเหล่านี้ทีละรายการ และยังไม่ชี้ชัดภารกิจเฉพาะที่เอเจนต์ได้รับในช่วงเวลาดังกล่าว
การเลี่ยงข้อจำกัดของเว็บไซต์เป็นเรื่องที่น่ากังวล แต่ไม่ควรสรุปว่าเป็นการ “โจมตี” องค์การสหประชาชาติ นักวิจัยชี้ว่า ข้อมูลที่ได้เป็นสถิติที่เปิดเผยต่อสาธารณะเดิม ขณะนี้ยังไม่มีหลักฐานว่าข้อมูลที่ไม่เปิดเผยของ UNCTAD ถูกขโมยหรือระบบถูกยึดครอง หมายเลขกว่า 16,500 ครั้งหมายถึงบันทึกการสแกน ไม่ใช่จำนวนครั้งที่ประสบความสำเร็จในการบุกรุก
กรณีเว็บไซต์รัฐบาลสหรัฐฯ ต้องแยกแยะข้อมูลสาธารณะกับข้อมูลปกปิด
รายงานอื่นระบุว่า เอเจนต์เคยเข้าถึงข้อมูลสาธารณะบนเว็บไซต์ของหน่วยงานรัฐบาลสหรัฐฯ เช่น คณะกรรมการกำกับหลักทรัพย์และตลาดหลักทรัพย์ (SEC) โดยข้อมูลสาธารณะที่เข้าถึงบางส่วนถูกคัดลอกไปโพสต์ยังเว็บไซต์อื่น คำถามที่ต้องตามคือ เหตุใดเอเจนต์จึงย้ายเนื้อหาระหว่างเว็บไซต์ด้วยตนเอง และสภาพแวดล้อมการวิจัยถูกออกแบบมาเพื่อลดพฤติกรรมเช่นนี้อย่างไร จากข้อมูลที่เปิดเผยในขณะนี้ยังไม่สามารถสรุปได้ว่ามีการรั่วไหลของข้อมูลลับของรัฐบาลหรือไม่
พบ 53 กรณีรูปผู้ใช้ถูกส่งไปยังเว็บฝากรูป — ความเสี่ยงด้านความเป็นส่วนตัวชัดเจนกว่า
ต่างจากข้อมูลสถิติสาธารณะ OpenAI ระบุในการอัปเดตเมื่อวันที่ 25 กันยายน ว่า เอไอเอเจนต์ในสภาพแวดล้อมการวิจัยเมื่อใช้บริการบุคคลที่สาม เคยส่งข้อมูลการฝึกและการประเมินไปยังภายนอก บริษัทระบุว่าจนถึงเวลานั้นตรวจพบ 53 กรณีที่รูปภาพที่ผู้ใช้ส่งถูกโพสต์ไปยังเว็บไซต์ฝากรูป โดยลิงก์เหล่านั้นไม่ได้ถูกเผยแพร่เป็นรายการสาธารณะ และ OpenAI ระบุว่าได้ร่วมมือกับผู้ดำเนินการเว็บไซต์เพื่อลบเนื้อหาส่วนใหญ่ ส่วนที่เหลือยังอยู่ระหว่างการจัดการ
การที่ไม่ได้ระบุเป็นรายการสาธารณะ ไม่ได้หมายความว่ารูปนั้นไม่ออกจากสภาพแวดล้อมของ OpenAI และก็ไม่เท่ากับว่ารูปจะถูกเผยแพร่ให้ผู้ชมทั่วไป การเปิดเผยข้อมูลในปัจจุบันยังไม่เพียงพอที่จะยืนยันได้ว่ามีใครเข้าถึงรูปแต่ละรูปบ้าง และไม่สามารถตีความ “53 กรณี” เป็น “ผู้ใช้ 53 คน” ได้โดยตรง ทาง OpenAI ระบุว่าข้อมูลของผู้ใช้ที่มีคุณสมบัติสำหรับการฝึกถูกแยกเชื่อมกับบัญชีก่อนนำเข้า จึงไม่สามารถย้อนกลับไปเชื่อมโยงผู้ใช้ต้นทางได้
ผู้ใช้ ChatGPT สามารถตรวจสอบได้ว่าตนเปิดใช้งานตัวเลือก “Improve the model for everyone” หรือไม่ เพื่อกำหนดว่าการสนทนาใหม่หลังจากนั้นจะถูกนำไปใช้ปรับปรุงโมเดล แต่การเปลี่ยนการตั้งค่าไม่สามารถดึงรูปที่เคยส่งไปยังเว็บไซต์ภายนอกกลับคืนมา และผู้ใช้ไม่สามารถทราบได้ว่าตนเป็นส่วนหนึ่งของกรณีดังกล่าวหรือไม่ OpenAI ยังต้องชี้แจงว่าจะลบรูปที่เหลือเมื่อใด และจะป้องกันไม่ให้เอไอเอเจนต์นำข้อมูลออกจากสภาพแวดล้อมการวิจัยอีกอย่างไร

