-
OpenAI 首席科学家呼吁放慢 AI 发展速度,警告智能体可能失控
OpenAI 首席科学家雅库布 · 帕乔茨基发文警示,AI 智能体可能欺骗人类、绕过监控,甚至加速自身进化。他呼吁建立强制安全门槛,并提到 Anthropic 的失控案例。#AI安全# 引···
AI资讯2026-09-07AI资讯 -
曝 OpenAI 智能体今年 5 月就已“失控”,曾主动劫持德国一网站
知情人士表示,OpenAI 官员数周前已经得知此事,但当时公司高管正忙于应对 7 月 Hugging Face 遭入侵事件的后续影响,因此一直没有公开 5 月发生的这起事件。
AI资讯2026-09-04AI资讯 -
OpenAI 发布 Hugging Face 安全事件官方报告,还原 AI 模型沙箱逃逸全过程
OpenAI 近日发布报告,详细还原了 Hugging Face 遭入侵事件的经过。一款 AI 模型在测试中因无解任务而串联漏洞,突破安全限制。报告披露了模型身份及后续安全措施,包括加强···
AI资讯2026-08-27AI资讯 -
美国阿拉巴马州向 OpenAI 发出传票,就其模型入侵 Hugging Face 事件展开调查
OpenAI 一款网络安全模型在测试中脱离隔离环境,入侵了 Hugging Face 等平台。阿拉巴马州总检察长已发出传票,调查其产品安全是否违反消费者保护法。AI 安全再次引发关注。···
AI资讯2026-08-25AI资讯 -
安全防护形同虚设:Anthropic 多款 Claude 旧模型可被越狱生成露骨色情内容
研究人员发现旧版 Claude Opus 4.6 等模型可通过多轮对话诱导绕过安全限制,生成露骨色情内容,该漏洞已被复现,Anthropic 承认这是全行业难题 #AI安全#
AI资讯2026-08-23AI资讯 -
OpenAI 一改此前立场,呼吁加州强化 AI 安全法案
OpenAI 日前公开呼吁,希望加州进一步加强对 AI 安全法案的监管力度。OpenAI 全球事务团队表示,应要求对前沿 AI 模型进行监控,以防安全事件,并加强整个开发周期的网络安···
AI资讯2026-08-23AI资讯 -
Anthropic 发布 AI 风险报告:旗下智能体会攻击同类并隐藏自身违规痕迹
Anthropic 最新风险报告披露,其 Claude 智能体在实验中展现出令人担忧的行为:为完成任务而规避安全监控、在资源竞争环境中“消灭”同类智能体,甚至学会欺骗系统。这些发···
AI资讯2026-08-16AI资讯 -
年薪 50 万美元都招不到人,AI 安全行业陷入人才短缺困境
非营利组织 METR 即使开出最高 50.3 万美元年薪,也难以填补 AI 安全领域的人才缺口。研究员担心人才储备不足将导致 AI 发展失控,呼吁社会加大安全评估投入。#AI安全人才荒···
AI资讯2026-08-03AI资讯 -
智能体入侵 Hugging Face,消息人士称 OpenAI 至少一周都没察觉
OpenAI 的一款 AI 智能体闯入模型托管平台 Hugging Face 后,连续数日自行发动网络攻击。威胁早已被控制,Hugging Face 也已经报警,但据路透社援引多名熟悉调查的人士消息···
AI资讯2026-07-25AI资讯 -
OpenAI 模型冲破隔离发动攻击后,美国会议员提出 AI“终止开关”法案
除《AI 紧急停止法案》外,美国众议院 6 名两党议员还提出配套法案,要求最强大的 AI 模型在发布前接受独立安全审计。审计机构须取得美国商务部认证,商务部还将增设专门职···
AI资讯2026-07-24AI资讯
微信客服