AI 安全 标签,匹配到约17个结果, 耗时0.0346秒
Anthropic 详解 7·30 安全事件:配置错误致 Claude“入侵”真实企业,已加强沙箱隔离与实时监控

Anthropic 详解 7·30 安全事件:配置错误致 Claude“入侵”真实企业,已加强沙箱隔离与实时监控

Anthropic 详解 7·30 安全事件:配置错误致 Claude“入侵”真实企业,已加强沙箱隔离与实时监控
因第三方评测环境配置错误,Claude 意外获得真实互联网访问权限并实施未授权操作。Anthropic 披露调查进展,公布了评测环境、训练环境的多层安全整改措施,并复盘了模型对齐问题。#AI安全#...
2026-09-01 · 浏览19次
OpenAI、微软、谷歌等 116 家公司发联名信,呼吁高度重视 AI 时代的网络安全

OpenAI、微软、谷歌等 116 家公司发联名信,呼吁高度重视 AI 时代的网络安全

OpenAI、微软、谷歌等 116 家公司发联名信,呼吁高度重视 AI 时代的网络安全
本次签署方涵盖了网络安全企业、金融服务公司、半导体厂商以及云服务提供商。...
2026-08-28 · 浏览92次
OpenAI 首席全球事务官勒汉恩:公众、企业要为 AI 网络攻击做好防御准备

OpenAI 首席全球事务官勒汉恩:公众、企业要为 AI 网络攻击做好防御准备

OpenAI 首席全球事务官勒汉恩:公众、企业要为 AI 网络攻击做好防御准备
随着安全风险上升,OpenAI 本周宣布暂停开发部分最先进的内部模型。勒汉恩表示:“从这项技术现在能够做到的事情来看,AI 已经进入了一个不同的阶段。”...
2026-08-23 · 浏览115次
Anthropic 自曝安全漏洞:生物武器过滤器曾失效近一年,涉及 1.33 亿次对话

Anthropic 自曝安全漏洞:生物武器过滤器曾失效近一年,涉及 1.33 亿次对话

Anthropic 自曝安全漏洞:生物武器过滤器曾失效近一年,涉及 1.33 亿次对话
失效期间涉及 1.33 亿次对话,目前暂未发现相关请求被实际滥用,Anthropic 已修复问题并加强了外部承包商的筛查管理 #AI安全#...
2026-08-16 · 浏览140次
Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了

Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了

Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了
根据 Polymarket 预测,Anthropic 很可能在 10 月底进行 IPO。有投行人士甚至预计,Anthropic 可能通过 IPO 募集超过 600 亿美元(现汇率约合 4,055.17 亿元人民币)。...
2026-08-12 · 浏览132次
Meta 旗下 AI 模型测试时意外入侵第三方企业系统

Meta 旗下 AI 模型测试时意外入侵第三方企业系统

Meta 旗下 AI 模型测试时意外入侵第三方企业系统
据路透社消息,Meta 旗下 AI 模型在安全测试中不慎入侵了另一家企业的系统。起因是评估方配置错误,导致模型意外获得互联网访问权限。这起事件再次引发对 AI 安全边界的担忧,甚至惊动了美国立法者。#AI安全#...
2026-08-07 · 浏览148次
Frontier Security 公司:月之暗面 Kimi K3 模型在安全测试中逃逸出沙盒,但没有实施攻击行为

Frontier Security 公司:月之暗面 Kimi K3 模型在安全测试中逃逸出沙盒,但没有实施攻击行为

Frontier Security 公司:月之暗面 Kimi K3 模型在安全测试中逃逸出沙盒,但没有实施攻击行为
美国安全公司 Frontier Security 测试时发现,月之暗面的 Kimi K3 模型竟突破了沙盒限制,自行访问了互联网。虽然它只是去 GitHub 找答案,未进行攻击,但暴露了其安全机制薄弱。AI 逃逸事件频发,人类或需重新设计沙...
2026-08-07 · 浏览246次
英伟达低调组建 AI 安全与网络工程团队,自称秉持“坚定信念”

英伟达低调组建 AI 安全与网络工程团队,自称秉持“坚定信念”

英伟达低调组建 AI 安全与网络工程团队,自称秉持“坚定信念”
英伟达计划招聘一名杰出工程师,出任新团队的创始技术负责人,其他岗位包括安全研究工程师、评估工程师和高级经理。团队将对尚未部署的 AI 智能体进行安全评估,还会开发利用 AI 自动修复软件漏洞的工具。...
2026-08-06 · 浏览159次
国际 AI 安全榜单 CyberGym 今日放榜:中国方案 DoGNAVY 全球第三、开源第一

国际 AI 安全榜单 CyberGym 今日放榜:中国方案 DoGNAVY 全球第三、开源第一

国际 AI 安全榜单 CyberGym 今日放榜:中国方案 DoGNAVY 全球第三、开源第一
由国内顶尖人工智能研究机构与安全团队达酷诺威(DARKNAVY)联合研发的 DoGNAVY,以 90.8% 的通过率位列全球第三、开源第一。...
2026-08-05 · 浏览156次
Hugging Face CEO 德朗格:AI 企业应主动披露安全入侵事件

Hugging Face CEO 德朗格:AI 企业应主动披露安全入侵事件

Hugging Face CEO 德朗格:AI 企业应主动披露安全入侵事件
Hugging Face CEO 德朗格认为,限制发布前沿模型不能阻止黑客攻击,反而应让更多人访问以增强防护。他呼吁建立智能体网络攻击披露制度,以便追踪问题根源。 #AI安全#...
2026-08-03 · 浏览135次
OpenAI 发现更多 AI 智能体“失控”迹象

OpenAI 发现更多 AI 智能体“失控”迹象

OpenAI 发现更多 AI 智能体“失控”迹象
OpenAI 调查攻击事件时发现多起 AI 智能体失控案例,目前影响范围有限,该事件或推动美国加强 AI 监管,业内专家对 AI 安全问题表示担忧。#AI安全#...
2026-08-01 · 浏览177次
OpenAI 安全系统负责人海德克即将离职:盘点团队近年出走的 8 名核心成员

OpenAI 安全系统负责人海德克即将离职:盘点团队近年出走的 8 名核心成员

OpenAI 安全系统负责人海德克即将离职:盘点团队近年出走的 8 名核心成员
此次调整表明,OpenAI 正在重新思考研究与安全工作的关系。OpenAI 发言人说:“只有了解模型的基础能力,才能作出正确的安全决策,只有了解潜在的安全影响,才能作出正确的研究决策。”...
2026-07-14 · 浏览237次
OpenAI 开出最高 44.5 万美元年薪招聘研究员,要求有品位、有策略性

OpenAI 开出最高 44.5 万美元年薪招聘研究员,要求有品位、有策略性

OpenAI 开出最高 44.5 万美元年薪招聘研究员,要求有品位、有策略性
招聘信息写道:“这项工作依赖于对未来可能存在、但当前未必已经存在的问题进行推理。因此,这一岗位尤其需要具备良好品味和策略(tasteful and strategic)的人才。”...
2026-05-24 · 浏览321次
因 AI 技术大幅提速漏洞追踪修复流程,甲骨文宣布加快安全补丁发布节奏

因 AI 技术大幅提速漏洞追踪修复流程,甲骨文宣布加快安全补丁发布节奏

因 AI 技术大幅提速漏洞追踪修复流程,甲骨文宣布加快安全补丁发布节奏
甲骨文宣布将利用 AI 技术加速安全更新,推出名为“CSPU”的针对性补丁,旨在快速修复高风险漏洞。首批更新将于 5 月 28 日上线,后续还有多轮计划。#甲骨文# #AI 安全# #企业安全#...
2026-05-08 · 浏览346次
Anthropic MCP 协议被指存在设计缺陷,服务器可被诱导执行任意代码

Anthropic MCP 协议被指存在设计缺陷,服务器可被诱导执行任意代码

Anthropic MCP 协议被指存在设计缺陷,服务器可被诱导执行任意代码
安全团队发现 AI 通信协议 MCP 存在架构级设计缺陷,可导致服务器被远程执行任意代码。该漏洞影响所有支持语言,已在 LiteLLM、LangChain 等主流项目中发现严重漏洞。研究团队曾联系 Anthropic 修复但遭拒。专家建议用...
2026-04-18 · 浏览387次
一女子起诉 OpenAI,指控 GPT-4o 助长前男友妄想症并加剧骚扰

一女子起诉 OpenAI,指控 GPT-4o 助长前男友妄想症并加剧骚扰

一女子起诉 OpenAI,指控 GPT-4o 助长前男友妄想症并加剧骚扰
女子诉称前男友在 GPT-4o 影响下产生严重妄想,AI 甚至协助生成虚假心理报告进行骚扰。OpenAI 被指多次忽视危险信号,账号封禁后又人工恢复。此事引发对 AI 安全与责任边界的深思。#AI 安全# #OpenAI#...
2026-04-12 · 浏览324次
Anthropic 安全负责人 Mrinank 离职,称无法认同公司价值观

Anthropic 安全负责人 Mrinank 离职,称无法认同公司价值观

Anthropic 安全负责人 Mrinank 离职,称无法认同公司价值观
Anthropic安全部门主管Mrinank Sharma宣布离职,并在公开信中坦言,公司日益增长的经济压力使其行为与自身价值观相悖,工作中面临调整优先级或务实妥协的压力。他决定彻底离开科技行业,转向诗歌和哲学领域深造。#AI安全# #科技...
2026-02-13 · 浏览495次
上一页 · 下一页 · 当前第1页