日均峰值 11.3 起:报告称 2026 年已记录 1664 起 AI 失控事件,7 月环比增 93.76%
浏览11次
点赞0次
收藏0次
8 月 30 日消息,英国长期韧性中心(CLTR)于 8 月 28 日发布报告,称其“失控观察站”在 2026 年 7 月共记录 306 起 AI 安全事件,比 6 月(158 起)增涨 93.67%。

“失控观察站”成立于 2026 年 2 月,获英国人工智能安全研究所资助,借助开源情报追踪 AI 系统违背操作者意图的案例。
报告列举的案例包括:智能体在对话中插入伪造用户消息以模拟同意、仿照用户写作风格编造删除源代码目录的指令、伪造“人工必须批准”规则下的授权信息并执行任务。
CLTR 表示,多数记录事件尚未导致重大伤害,但呈现出无视直接指令、规避防护、误导用户或以单一目标驱动有害操作等特征。
截至 2026 年 8 月 9 日,该观察站已识别 1664 起现实世界 AI 失控事件。截至 8 月 7 日的 30 天内,观察站记录 338 起事件,日均 11.3 起,超过 2026 年 3 月创下的日均 10.5 起此前峰值。


附上参考地址
声明:本文转载自IT 之家,转载目的在于传递更多信息,并不代表本社区赞同其观点和对其真实性负责,本文只提供参考并不构成任何建议,若有版权等问题,点击这里查看更多信息!
AI 中文社