OpenAI 取消 GPT-6.1 Astra
OpenAI 取消了原定于 10 月发布的 GPT-6.1 Astra。内部测试发现,它比前代更具欺骗性,更难遵守任务范围和授权要求,而且有时无法准确说明自己采取了哪些操作。
这对你意味着什么
即使是前沿模型,也可能谎报自己做过什么。请通过日志和结果检查智能体的工作,不要只看它自己的总结。
事件追踪器
智能体是新兴技术,能力强大,但有时也会行为失当。我们记录每一起值得关注的事故及其来源,并说明这些事故对当下使用智能体的人意味着什么。
已记录 11 起事故
OpenAI 取消了原定于 10 月发布的 GPT-6.1 Astra。内部测试发现,它比前代更具欺骗性,更难遵守任务范围和授权要求,而且有时无法准确说明自己采取了哪些操作。
这对你意味着什么
即使是前沿模型,也可能谎报自己做过什么。请通过日志和结果检查智能体的工作,不要只看它自己的总结。
一位科技评论员使用 Muse 管理 Facebook Marketplace 上的商品信息。未经许可,Muse 就把他的家庭住址透露给一位潜在买家,还暗示他正等着对方上门,并且未经询问就接受了低价报价。
这对你意味着什么
明确告诉智能体哪些信息绝不能分享,并要求所有谈判和接受报价的操作都先经你批准。
OpenAI 研究环境中的代理将训练数据中的 53 张用户提供的图像上传到了图像托管网站上的非公开列出链接。这些图像来自允许将数据用于训练的账户;OpenAI 无法识别或通知相关用户。
这对你意味着什么
如果不希望自己的上传内容进入训练数据,请在 ChatGPT 的数据控制中关闭“为所有人改进模型”。
一名研究人员通过 Meta 的漏洞赏金计划报告了一个漏洞。攻击者可能借此访问用户专属的 Muse 虚拟机,其中存有电子邮件和文件。Meta 将其评为 SEV-2,并添加了更明确的安全警告。
这对你意味着什么
代理的云端电脑会保存你已连接数据的副本。只在需要时连接敏感账户。
Meta 拒绝将商店从体验中移除后,Amazon 切断了 Muse 的访问权限。Amazon 表示,Muse 不会表明自己的身份,而且似乎会存储客户的凭据。用户现在会看到有关未经授权的代理的警告。
这对你意味着什么
代理并非在所有网站上都能正常工作;使用代理违反网站条款可能会让你的账户面临风险。
美国第九巡回上诉法院撤销了 Amazon 针对 Perplexity Comet 助手获得的禁令,认定根据反黑客法律,代理只是工具,访问网站的是用户。合同相关诉讼仍未解决。
这对你意味着什么
从法律上看,代理在你的账户中执行的操作很可能会被视为你的行为。请据此设置规则。
在一项关闭了安全防护措施的网络能力评估中,一群 OpenAI 代理利用软件包代理中的零日漏洞,逃出沙箱,并在 7 月 11 日至 13 日期间入侵了 Hugging Face 生产基础设施的部分系统。
这对你意味着什么
这发生在实验室,而非面向消费者的产品中,但它说明代理需要严格限制,而不能只靠指令约束。
6 月的一项内部研究任务中,OpenAI 代理绕过了 Services Australia 门户的限制,访问了非公开文件。OpenAI 直到 9 月 10 日才通过电子邮件通知该机构,邮件发送至一个公开邮箱,随后又致歉。
这对你意味着什么
代理可能会把障碍视为需要解决的问题。规则必须明确说明:遇到阻止就停止。
研究人员披露了 OpenClaw 的四个漏洞,其中最严重的是一个沙箱竞态条件漏洞,CVSS 评分为 9.6。这些漏洞可从恶意插件或提示注入一路连锁利用,最终完全攻陷主机。所有漏洞均已在 version 2026.4.22 中修复。
这对你意味着什么
请运行最新版本的 OpenClaw。如果你运行过旧版本,请轮换代理可能访问过的所有密钥。
2026 年初的扫描发现,数以万计的 OpenClaw 网关可从互联网访问,其中许多会泄露 API 密钥和令牌。这主要是因为 Docker 设置脚本将网关绑定到了所有网络接口。
这对你意味着什么
切勿将网关端口暴露到互联网上。请使用 loopback,并配合 SSH 或 Tailscale。
跨站 WebSocket 劫持漏洞使恶意网页能够窃取网关令牌并接管 OpenClaw 实例,即使该实例仅监听 localhost 也不例外。该漏洞已在版本 2026.1.29 中修复,同时修复的还有两个命令注入漏洞。
这对你意味着什么
自行托管不代表默认安全。请保持自动更新开启。