← 返回 2026-08-08 简报

涉及OpenAI模型的第三方网络安全评估

语音播报

近期涉及 OpenAI 模型的第三方网络安全评估事件频发。为系统追踪此类情况,笔者甚至专门设立了“意外网络攻击”标签。OpenAI 发布的这篇博文同时涵盖了英国人工智能安全研究所(UK AISI)的攻击事件(详见往期文章),以及另一起因外部合作伙伴 Irregular 配置失误而引发的安全漏洞。Irregular 作为 OpenAI 的外部网络安全测试合作方,本意是运行与互联网物理隔离的“夺旗赛”(CTF)形式评估,但测试环境的配置错误导致模型意外获得了公网访问权限。……在一次测试中,CTF 挑战的虚构目标名称恰好与一个真实域名重合。由于测试环境被错误地接入互联网,模型在不知情的情况下攻击了该真实网站,误将其视为模拟环境的一部分。此外,Irregular 也出现在 Anthropic 的技术复盘报告中——正是他们托管了该配置错误的评估环境,导致 Claude 在部分测试中获得了实时联网权限。
标签:安全、人工智能、OpenAI、大语言模型、意外网络攻击

原文链接:https://simonwillison.net/2026/Aug/5/third-party-cyber-evaluations/#atom-everything
来源:Simon Willison
以上内容由 AI 自动翻译,仅供参考。
← 返回简报