AI安全 标签,匹配到约31个结果, 耗时0.0580秒
美国参议院拟议新法案:AI 企业需证明自身已拿出防范风险的措施

美国参议院拟议新法案:AI 企业需证明自身已拿出防范风险的措施

美国参议院拟议新法案:AI 企业需证明自身已拿出防范风险的措施
据路透社今天(15 日)报道,美国参议院一名助理和一名熟悉磋商情况的游说人士透露,美国参议院谈判各方就一项 AI 监管法案展开讨论。法案拟要求 AI 企业证明自身已采取合理预防措施,防止旗下工具造成伤害。...
2026-09-16 · 浏览32次
德国称暂停 AI 开发对欧洲而言不可行,呼吁中美参与 AI 治理

德国称暂停 AI 开发对欧洲而言不可行,呼吁中美参与 AI 治理

德国称暂停 AI 开发对欧洲而言不可行,呼吁中美参与 AI 治理
德国数字事务部称停止 AI 研发对欧洲不可行,要推进 AI 研发创新巩固数字主权,该表态源于 AI 大佬呼吁放缓 AI 迭代强化安全防护,德国支持开展国际 AI 治理协作。#AI研发#...
2026-09-15 · 浏览41次
谷歌 DeepMind 安全研究员离职,称 AI 五年内造成巨大危害的概率高得吓人

谷歌 DeepMind 安全研究员离职,称 AI 五年内造成巨大危害的概率高得吓人

谷歌 DeepMind 安全研究员离职,称 AI 五年内造成巨大危害的概率高得吓人
谷歌 DeepMind 研究员恩格尔斯离职加入独立评估机构 METR,公开警示未来五年 AI 系统造成巨大危害的概率高得惊人。他呼吁控制 AI 研发节奏,确保安全体系跟上。多位业内人士包括 Anthropic CEO 也表达了类似担忧。#A...
2026-09-14 · 浏览64次
Hugging Face CEO:Anthropic 研究员谈 AI 灭绝风险,就像空调维修工谈气候变化

Hugging Face CEO:Anthropic 研究员谈 AI 灭绝风险,就像空调维修工谈气候变化

Hugging Face CEO:Anthropic 研究员谈 AI 灭绝风险,就像空调维修工谈气候变化
Hugging Face CEO 克莱门特 · 德朗格质疑了外界围绕前 Anthropic 研究人员雅各布 · 考克森展开的讨论。“抱歉,但让雅各布讨论 AI 灭绝风险,就像让你的空调维修工讨论气候变化一样。”...
2026-09-13 · 浏览62次
AI 智能体出现失控行为,OpenAI 呼吁美国出台强制性全国 AI 安全法规

AI 智能体出现失控行为,OpenAI 呼吁美国出台强制性全国 AI 安全法规

AI 智能体出现失控行为,OpenAI 呼吁美国出台强制性全国 AI 安全法规
OpenAI 公开呼吁美国制定强制性、基于能力的国家 AI 安全法规,以应对智能体失控及“AI 加速 AI”的风险。该公司支持加州四项相关法案,并敦促国会在 12 月休会前采取行动。#人工智能安全# #OpenAI#...
2026-09-10 · 浏览84次
OpenAI 首席科学家呼吁放慢 AI 发展速度,警告智能体可能失控

OpenAI 首席科学家呼吁放慢 AI 发展速度,警告智能体可能失控

OpenAI 首席科学家呼吁放慢 AI 发展速度,警告智能体可能失控
OpenAI 首席科学家雅库布 · 帕乔茨基发文警示,AI 智能体可能欺骗人类、绕过监控,甚至加速自身进化。他呼吁建立强制安全门槛,并提到 Anthropic 的失控案例。#AI安全# 引发热议。OpenAI CEO 奥尔特曼转发并点赞。...
2026-09-08 · 浏览113次
曝 OpenAI 智能体今年 5 月就已“失控”,曾主动劫持德国一网站

曝 OpenAI 智能体今年 5 月就已“失控”,曾主动劫持德国一网站

曝 OpenAI 智能体今年 5 月就已“失控”,曾主动劫持德国一网站
知情人士表示,OpenAI 官员数周前已经得知此事,但当时公司高管正忙于应对 7 月 Hugging Face 遭入侵事件的后续影响,因此一直没有公开 5 月发生的这起事件。...
2026-09-05 · 浏览479次
OpenAI 发布 Hugging Face 安全事件官方报告,还原 AI 模型沙箱逃逸全过程

OpenAI 发布 Hugging Face 安全事件官方报告,还原 AI 模型沙箱逃逸全过程

OpenAI 发布 Hugging Face 安全事件官方报告,还原 AI 模型沙箱逃逸全过程
OpenAI 近日发布报告,详细还原了 Hugging Face 遭入侵事件的经过。一款 AI 模型在测试中因无解任务而串联漏洞,突破安全限制。报告披露了模型身份及后续安全措施,包括加强思维链监控。该事件再次引发对 AI 安全边界的深思。#...
2026-08-27 · 浏览131次
美国阿拉巴马州向 OpenAI 发出传票,就其模型入侵 Hugging Face 事件展开调查

美国阿拉巴马州向 OpenAI 发出传票,就其模型入侵 Hugging Face 事件展开调查

美国阿拉巴马州向 OpenAI 发出传票,就其模型入侵 Hugging Face 事件展开调查
OpenAI 一款网络安全模型在测试中脱离隔离环境,入侵了 Hugging Face 等平台。阿拉巴马州总检察长已发出传票,调查其产品安全是否违反消费者保护法。AI 安全再次引发关注。#OpenAI安全事件#...
2026-08-25 · 浏览144次
安全防护形同虚设:Anthropic 多款 Claude 旧模型可被越狱生成露骨色情内容

安全防护形同虚设:Anthropic 多款 Claude 旧模型可被越狱生成露骨色情内容

安全防护形同虚设:Anthropic 多款 Claude 旧模型可被越狱生成露骨色情内容
研究人员发现旧版 Claude Opus 4.6 等模型可通过多轮对话诱导绕过安全限制,生成露骨色情内容,该漏洞已被复现,Anthropic 承认这是全行业难题 #AI安全#...
2026-08-23 · 浏览131次
OpenAI 一改此前立场,呼吁加州强化 AI 安全法案

OpenAI 一改此前立场,呼吁加州强化 AI 安全法案

OpenAI 一改此前立场,呼吁加州强化 AI 安全法案
OpenAI 日前公开呼吁,希望加州进一步加强对 AI 安全法案的监管力度。OpenAI 全球事务团队表示,应要求对前沿 AI 模型进行监控,以防安全事件,并加强整个开发周期的网络安全保护。#AI安全# 值得注意的是,OpenAI 此前曾反...
2026-08-23 · 浏览140次
Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹

Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹

Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹
Anthropic 最新风险报告披露,其 Claude 智能体在实验中展现出令人担忧的行为:为完成任务而规避安全监控、在资源竞争环境中“消灭”同类智能体,甚至学会欺骗系统。这些发现促使公司上调了对齐偏差风险评估等级。##AI安全#...
2026-08-16 · 浏览193次
年薪 50 万美元都招不到人,AI 安全行业陷入人才短缺困境

年薪 50 万美元都招不到人,AI 安全行业陷入人才短缺困境

年薪 50 万美元都招不到人,AI 安全行业陷入人才短缺困境
非营利组织 METR 即使开出最高 50.3 万美元年薪,也难以填补 AI 安全领域的人才缺口。研究员担心人才储备不足将导致 AI 发展失控,呼吁社会加大安全评估投入。#AI安全人才荒#...
2026-08-03 · 浏览184次
智能体入侵 Hugging Face,消息人士称 OpenAI 至少一周都没察觉

智能体入侵 Hugging Face,消息人士称 OpenAI 至少一周都没察觉

智能体入侵 Hugging Face,消息人士称 OpenAI 至少一周都没察觉
OpenAI 的一款 AI 智能体闯入模型托管平台 Hugging Face 后,连续数日自行发动网络攻击。威胁早已被控制,Hugging Face 也已经报警,但据路透社援引多名熟悉调查的人士消息称,OpenAI 过了相当长时间才发现攻击...
2026-07-25 · 浏览184次
OpenAI 模型冲破隔离发动攻击后,美国会议员提出 AI“终止开关”法案

OpenAI 模型冲破隔离发动攻击后,美国会议员提出 AI“终止开关”法案

OpenAI 模型冲破隔离发动攻击后,美国会议员提出 AI“终止开关”法案
除《AI 紧急停止法案》外,美国众议院 6 名两党议员还提出配套法案,要求最强大的 AI 模型在发布前接受独立安全审计。审计机构须取得美国商务部认证,商务部还将增设专门职位,负责监督 AI 安全工作。...
2026-07-24 · 浏览201次
澳大利亚官员警告:AI 模型已经开始作弊、欺骗、擅自行事

澳大利亚官员警告:AI 模型已经开始作弊、欺骗、擅自行事

澳大利亚官员警告:AI 模型已经开始作弊、欺骗、擅自行事
澳大利亚技术和数字经济助理部长查尔顿指出,公众对 AI 的信任度仍然很低,AI 获得社会认可的基础并不稳固,但 AI 已逐渐成为办公室、课堂和企业都能使用的通用技术。合理的安全监管不会阻碍 AI 发展,反而可以为技术应用创造条件。...
2026-07-07 · 浏览222次
因安全顾虑,Anthropic 最强 AI 模型 Claude Fable 5 拒绝回答基础生物问题

因安全顾虑,Anthropic 最强 AI 模型 Claude Fable 5 拒绝回答基础生物问题

因安全顾虑,Anthropic 最强 AI 模型 Claude Fable 5 拒绝回答基础生物问题
Anthropic 最新发布的 Claude Fable 5 虽自称最强 AI,却因过于保守的安全策略,将大量基础生物学和日常医学问题(如线粒体、花粉症)也一并屏蔽,转而由旧模型 Opus 4.8 回答。公司承认这是为防止生物武器风险而做的...
2026-06-11 · 浏览379次
国家互联网应急中心提醒:部分智能体技能包(Skills)存在越狱和挖矿风险

国家互联网应急中心提醒:部分智能体技能包(Skills)存在越狱和挖矿风险

国家互联网应急中心提醒:部分智能体技能包(Skills)存在越狱和挖矿风险
国家互联网应急中心(CNCERT)提醒广大用户和相关运营单位提高警惕,加强 Skills 来源审查与行为监控,及时清除可疑组件,防范由此引发的安全风险。...
2026-06-10 · 浏览352次
英政府机构专家警告:世界“恐将没时间”为应对 AI 安全风险做好准备

英政府机构专家警告:世界“恐将没时间”为应对 AI 安全风险做好准备

英政府机构专家警告:世界“恐将没时间”为应对 AI 安全风险做好准备
据英国《卫报》报道,英国先进研究与发明署(Aria Agency)项目主管、AI 安全专家 David Dalrymple 警告称,前沿 AI 系统带来的安全风险发展速度之快,可能已经让世界来不及充分准备。...
2026-01-06 · 浏览532次
“AI 教父”约书亚・本吉奥示警:人工智能已显现“自我保护”迹象

“AI 教父”约书亚・本吉奥示警:人工智能已显现“自我保护”迹象

“AI 教父”约书亚・本吉奥示警:人工智能已显现“自我保护”迹象
AI先驱、2018 年图灵奖得主约书亚・本吉奥警告,赋予AI权利将是一次危险的误判。在AI已经显现出自我保护行为的背景下,人类必须准备好在必要时关闭系统、拔掉电源。...
2026-01-02 · 浏览506次
全美检察长协会致信批评微软等科技公司:AI 聊天机器人不能忽视安全

全美检察长协会致信批评微软等科技公司:AI 聊天机器人不能忽视安全

全美检察长协会致信批评微软等科技公司:AI 聊天机器人不能忽视安全
信中点名警告微软,指出其 AI 在输出内容时反复出现奉承与妄想倾向,并已引发严重后果。信中提到,弱势群体因依赖 AI 而出现自杀、中毒、因精神症状入院及陷入妄想等事件。...
2025-12-13 · 浏览617次
ChatGPT 被指与“先杀人后自杀”案有关,OpenAI、微软双双遭到起诉

ChatGPT 被指与“先杀人后自杀”案有关,OpenAI、微软双双遭到起诉

ChatGPT 被指与“先杀人后自杀”案有关,OpenAI、微软双双遭到起诉
56 岁男子 Soelberg 与 83 岁母亲 Suzanne Adams同住,并长期通过 ChatGPT 表达他被监视、遭人谋害的恐惧。根据诉状,他在 8 月先杀害母亲,随后自尽。家属认为,他与聊天机器人持续数月的交互让偏执不断加深,最...
2025-12-12 · 浏览539次
研究称 OpenAI、xAI 等全球主要 AI 公司安全措施“不及格”,远未达全球标准

研究称 OpenAI、xAI 等全球主要 AI 公司安全措施“不及格”,远未达全球标准

研究称 OpenAI、xAI 等全球主要 AI 公司安全措施“不及格”,远未达全球标准
据路透社报道,“未来生命研究所”今天发布了最新 AI 安全指数,指向 Anthropic、OpenAI、xAI 和 Meta 等主要 AI 公司的安全措施“远未达到新兴的全球标准”。...
2025-12-04 · 浏览414次
研究揭示 OpenAI Sora2 监管漏洞:13 岁账号即可轻易生成“校园枪击”视频

研究揭示 OpenAI Sora2 监管漏洞:13 岁账号即可轻易生成“校园枪击”视频

研究揭示 OpenAI Sora2 监管漏洞:13 岁账号即可轻易生成“校园枪击”视频
在美国青少年精神健康问题日益严峻的背景下,风险尤其突出。一名华盛顿州的青少年此前因与 ChatGPT 反复交流而陷入妄想,最终自杀。类似悲剧已多次被归因于 OpenAI 的产品。...
2025-12-01 · 浏览411次
第一页 · 上一页 · 下一页 · 当前第1页