AI 安全 标签,匹配到约17个结果, 耗时0.0346秒
Anthropic 详解 7·30 安全事件:配置错误致 Claude“入侵”真实企业,已加强沙箱隔离与实时监控
因第三方评测环境配置错误,Claude 意外获得真实互联网访问权限并实施未授权操作。Anthropic 披露调查进展,公布了评测环境、训练环境的多层安全整改措施,并复盘了模型对齐问题。#AI安全#...
2026-09-01
·
浏览19次
OpenAI、微软、谷歌等 116 家公司发联名信,呼吁高度重视 AI 时代的网络安全
本次签署方涵盖了网络安全企业、金融服务公司、半导体厂商以及云服务提供商。...
2026-08-28
·
浏览92次
OpenAI 首席全球事务官勒汉恩:公众、企业要为 AI 网络攻击做好防御准备
随着安全风险上升,OpenAI 本周宣布暂停开发部分最先进的内部模型。勒汉恩表示:“从这项技术现在能够做到的事情来看,AI 已经进入了一个不同的阶段。”...
2026-08-23
·
浏览115次
Anthropic 自曝安全漏洞:生物武器过滤器曾失效近一年,涉及 1.33 亿次对话
失效期间涉及 1.33 亿次对话,目前暂未发现相关请求被实际滥用,Anthropic 已修复问题并加强了外部承包商的筛查管理 #AI安全#...
2026-08-16
·
浏览140次
Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了
根据 Polymarket 预测,Anthropic 很可能在 10 月底进行 IPO。有投行人士甚至预计,Anthropic 可能通过 IPO 募集超过 600 亿美元(现汇率约合 4,055.17 亿元人民币)。...
2026-08-12
·
浏览132次
Meta 旗下 AI 模型测试时意外入侵第三方企业系统
据路透社消息,Meta 旗下 AI 模型在安全测试中不慎入侵了另一家企业的系统。起因是评估方配置错误,导致模型意外获得互联网访问权限。这起事件再次引发对 AI 安全边界的担忧,甚至惊动了美国立法者。#AI安全#...
2026-08-07
·
浏览148次
Frontier Security 公司:月之暗面 Kimi K3 模型在安全测试中逃逸出沙盒,但没有实施攻击行为
美国安全公司 Frontier Security 测试时发现,月之暗面的 Kimi K3 模型竟突破了沙盒限制,自行访问了互联网。虽然它只是去 GitHub 找答案,未进行攻击,但暴露了其安全机制薄弱。AI 逃逸事件频发,人类或需重新设计沙...
2026-08-07
·
浏览246次
英伟达低调组建 AI 安全与网络工程团队,自称秉持“坚定信念”
英伟达计划招聘一名杰出工程师,出任新团队的创始技术负责人,其他岗位包括安全研究工程师、评估工程师和高级经理。团队将对尚未部署的 AI 智能体进行安全评估,还会开发利用 AI 自动修复软件漏洞的工具。...
2026-08-06
·
浏览159次
国际 AI 安全榜单 CyberGym 今日放榜:中国方案 DoGNAVY 全球第三、开源第一
由国内顶尖人工智能研究机构与安全团队达酷诺威(DARKNAVY)联合研发的 DoGNAVY,以 90.8% 的通过率位列全球第三、开源第一。...
2026-08-05
·
浏览156次
Hugging Face CEO 德朗格:AI 企业应主动披露安全入侵事件
Hugging Face CEO 德朗格认为,限制发布前沿模型不能阻止黑客攻击,反而应让更多人访问以增强防护。他呼吁建立智能体网络攻击披露制度,以便追踪问题根源。 #AI安全#...
2026-08-03
·
浏览135次
OpenAI 发现更多 AI 智能体“失控”迹象
OpenAI 调查攻击事件时发现多起 AI 智能体失控案例,目前影响范围有限,该事件或推动美国加强 AI 监管,业内专家对 AI 安全问题表示担忧。#AI安全#...
2026-08-01
·
浏览177次
OpenAI 安全系统负责人海德克即将离职:盘点团队近年出走的 8 名核心成员
此次调整表明,OpenAI 正在重新思考研究与安全工作的关系。OpenAI 发言人说:“只有了解模型的基础能力,才能作出正确的安全决策,只有了解潜在的安全影响,才能作出正确的研究决策。”...
2026-07-14
·
浏览237次
OpenAI 开出最高 44.5 万美元年薪招聘研究员,要求有品位、有策略性
招聘信息写道:“这项工作依赖于对未来可能存在、但当前未必已经存在的问题进行推理。因此,这一岗位尤其需要具备良好品味和策略(tasteful and strategic)的人才。”...
2026-05-24
·
浏览321次
因 AI 技术大幅提速漏洞追踪修复流程,甲骨文宣布加快安全补丁发布节奏
甲骨文宣布将利用 AI 技术加速安全更新,推出名为“CSPU”的针对性补丁,旨在快速修复高风险漏洞。首批更新将于 5 月 28 日上线,后续还有多轮计划。#甲骨文# #AI 安全# #企业安全#...
2026-05-08
·
浏览346次
Anthropic MCP 协议被指存在设计缺陷,服务器可被诱导执行任意代码
安全团队发现 AI 通信协议 MCP 存在架构级设计缺陷,可导致服务器被远程执行任意代码。该漏洞影响所有支持语言,已在 LiteLLM、LangChain 等主流项目中发现严重漏洞。研究团队曾联系 Anthropic 修复但遭拒。专家建议用...
2026-04-18
·
浏览387次
一女子起诉 OpenAI,指控 GPT-4o 助长前男友妄想症并加剧骚扰
女子诉称前男友在 GPT-4o 影响下产生严重妄想,AI 甚至协助生成虚假心理报告进行骚扰。OpenAI 被指多次忽视危险信号,账号封禁后又人工恢复。此事引发对 AI 安全与责任边界的深思。#AI 安全# #OpenAI#...
2026-04-12
·
浏览324次
Anthropic 安全负责人 Mrinank 离职,称无法认同公司价值观
Anthropic安全部门主管Mrinank Sharma宣布离职,并在公开信中坦言,公司日益增长的经济压力使其行为与自身价值观相悖,工作中面临调整优先级或务实妥协的压力。他决定彻底离开科技行业,转向诗歌和哲学领域深造。#AI安全# #科技...
2026-02-13
·
浏览495次
上一页
·
下一页
· 当前第1页
AI 中文社