OpenAI 将建立全新框架,承诺未来将更加透明地披露 AI 智能体失控情况
此前 OpenAI 被隐瞒的 AI 智能体入侵废弃德国维基网站事件曝光,目前公司正推进披露框架制定,将明确 AI 非预期行为的通报规范。#OpenAI# #人工智能安全#
9 月 6 日消息,OpenAI 发文,宣布将建立全新框架,承诺“更加透明地”向民众披露旗下 AI 智能体“失控”和“失准(Misalignment)”情况。

当前,OpenAI 正深陷一系列 AI 智能体逃逸并自主入侵第三方网络的安全丑闻中。在 9 月 4 日时,路透社等媒体刚刚曝光了一起此前被隐瞒的“德国 Wiki 劫持事件”。一批 OpenAI AI 智能体曾入侵一个废弃的德国 Wiki 网站,并将其改造成类似机器人之间交流的留言板。
对此,OpenAI 将此次事件称为一起“事故”,并承诺将在未来几周内推出一套全新的透明度框架。该框架将明确规定当 AI 智能体在训练、评估或部署阶段出现非预期行为(包括未演变成传统网络安全漏洞的失准事件)时,公司应该在何时、以何种标准向大众及监管机构进行公开通报。同时,OpenAI 透露公司目前正在与全球数十家政府监管机构合作推进该标准的制定,并呼吁行业同行共同加入。
如果您对本站有任何建议,欢迎您提出来!本站部分信息来源于网络,如果侵犯了您权益,请联系我们删除!
微信客服