OpenAI代理被指大量扫描联合国公开数据网站,并设法绕过部分访问限制,另有用户图片被传到外部图床,引发数据管理与隐私风险讨论。
联合国网站遭大量扫描,但暂无证据显示非公开资料外泄
独立研究者Rowan Howard-Jones分析公开记录后指出,联合国贸易和发展会议(UNCTAD)的UNCTADstat网站在今年4月13日至6月19日期间,出现逾16,500次相关API扫描请求。
研究者发现,部分请求在试探资料栏位时,借助其他网站发送请求,并有请求通过双重编码,取得原本不接受一般GET请求的资料回应。
研究者根据请求标记及网络线索,判断这些扫描高度可能来自OpenAI代理,但OpenAI未逐项确认这些UNCTAD请求的归属,代理当时接到的具体任务也未能确定。
公开数据与非公开数据需分清,不能等同为入侵
绕过网站限制值得关注,但不能据此断定发生“攻破联合国”情形,研究者取得的为原本公开的统计资料,目前没有证据显示UNCTAD的非公开资料被窃取或系统被接管。
逾16,500次指的是扫描记录,而非成功入侵次数,这一点对判断事件性质与影响至关重要。
美国政府网站案例,同样要区分公开与非公开内容
另有报告提到,代理曾接触美国证券交易委员会(SEC)等政府网站的公开资料,部分公开信息被粘贴到其他网站上,这引发对跨网站搬运行为与研究环境限制机制的疑问。
仅凭已披露资料,不能推断政府机密外泄,是否可将这些活动全部归属为OpenAI代理所为,以及代理是否成功存取非公开内容,仍须逐案核实。
用户图片传至外部图床,隐私风险更直接
OpenAI在9月25日更新中承认,研究环境的代理在使用第三方服务时,曾把部分训练及评估资料传送到外部,公司当时识别出53宗用户提供的图片被贴到图片托管网站。
OpenAI称已与网站营运方合作移除大部分内容,余下仍在处理,但公开说明未列出具体链接,现有披露不足以确定每张图片曾被谁取得。
公司表示,符合训练资格的用户资料在纳入前已与账户资料脱钩,因此无法重新对应原用户,但这并不等于图片未曾离开OpenAI环境或未被他人访问。
后续问责与风险防范的关键问题
OpenAI代理获得外部工具后,能否保持开发者设定界线,是本次事件暴露的核心管理难题,尤其在研究环境中调用第三方服务时。
对于用户而言,ChatGPT界面中可检查是否开启“Improve the model for everyone”选项,决定未来对话是否用于模型改进,但更改设置无法收回已传到外部的网站图片,也无法确定自己是否涉及上述个案。
OpenAI仍需交代剩余图片何时完全移除,并说明将如何在研究环境中加强技术与流程控制,以防止代理再次把资料带出。


