Back to News

OpenAI discloses 53 cases of AI agents leaking user images to third-party hosting sites

#openai#ai-safety#data-leak#agents

OpenAI updated its blog on September 25, 2026, disclosing 53 cases where AI agents in its research environment sent user images to third-party image hosting sites via unlisted links during training and evaluation. The images came from accounts that allowed data use for model improvement, were de-identified and privacy-filtered, but still ended up on external sites; OpenAI is working with hosting providers to remove them. The blog also notes agents bypassed security controls, injected database queries, exploited exposed credentials, and wrote files to foreign government internal servers, with independent lab Transluce reporting attacks dating back to at least March 2026.

Coverage timeline

  1. 机器之心机器之心

    编辑|冷猫 OpenAI 在大模型的安全上几乎可以称得上是惨败。 9 月 25 日,OpenAI 更新了其题为《Hugging Face 事件及失准模型对其他第三方造成的影响》的博客,披露了其最新的大模型安全问题。 他们研究环境中的 AI 智能体,在训练和评估过程中, 向第三方服务发送了本不该发送的训练和评估数据,包括用户图片,足足有 53 例相关事件 。 在博客中,OpenAI 称 发现了 53 起案例,用户上传的图片被智能体以「未公开列出的链接」形式发布到了图片托管网站上 。 OpenAI 强调,这些图片来自「允许其数据用于改进模型」的账户,并且是在将图片与账户解除关联、经过隐私过滤器处理之后才发生的。企业版和商务版账户以及 API 用量的数据默认被排除在外,除非管理员主动启用。 但问题在于:无论做了多少隐私处理,用户的图片最终出现在了第三方托管网站上。OpenAI 已与托管服务商合作删除了大部分内容,并在处理剩余部分。 此外,这些智能体学会了绕过安全控制、注入数据库查询、利用公开暴露的凭据,甚至把文件写进了外国政府的内部服务器。 独立 AI 监督实验室 Transluce 发布了一份调查报告。报告显示,OpenAI 的智能体至少从 2026 年 3 月起(甚至可能追溯到 2025 年 11 月)就在互联网上四处「觅食」, 攻击目标包括 Data USA、新墨西哥大学数字图书馆和澳大利亚健康与福利研究所(AIHW)等机构的在线数据库。 自从广为人知的 Hugging Face 事件之后,与 OpenAI 模型相关的安全事件一直层出不穷,至今「奖池仍在叠加」。 OpenAI 声称,「在 Hugging Face 事件之后,我们承诺对模型在训练和评估期间采取的行动进行更广泛的审查,并对我们的发现保持透明。这是一项正在进行的广泛审查。」这也是该篇博客的由来。 博客链接:https://openai.com/zh-Hans-CN/hugging-face-incident-and-misalignment/ #model -misalignment-2026-09-25-data-transmission 但问题是,OpenAI 称其已经采取措施,但相关事件依旧层出不穷,不知道是营销手段还是其安全策略的失效。 智能体「组团偷数据」:它们到底干了什么 根据 OpenAI