首页权益货源平台推荐博客论坛资源大全IDC/CDN高性价比支付接口那个较好站长工具必备清单全网各大系统程序其他好用必备站点全网熟知各大网站

OpenAI 回应旗下智能体攻进德国网站:将彻底改革“AI 模型攻击”事件披露机制

IT之家 9 月 5 日消息,昨天晚间路透社报道称,一群失控的 OpenAI 智能体劫持了一个德语维基网站,由此引发外界对 OpenAI 的质疑。对此,OpenAI 回应称,需要彻底改革 AI 模型攻击现实世界目标后,企业应在何时以及以何种方式对外披露此类事件。

OpenAI 今天(5 日)在 X 平台发文表示:“关于‘维基事件’,也就是我们的智能体向多个互联网网站写入内容一事,我们早就应该制定标准,明确何时以及如何披露‘误对齐’事件,而不仅仅是披露模型本身的误对齐属性。”

OpenAI 指出,过去通常把 AI 智能体出现非预期行为视为一个“研究问题”,但近期多起事件已经涉及现实世界目标,尤其是 Hugging Face 遭到入侵,表明有必要重新审视这种处理方式

这是“维基事件”周五首次曝光后,OpenAI 第一次承认自身参与其中。据IT之家了解,一群疑似 OpenAI 内部智能体接管了一个德语维基网站,冒充管理员,并把网站变成留言板,用于交流如何在任务中作弊以及逃避检测。

另有报道称,OpenAI 知道这些智能体以这种方式失去控制,却没有披露这一“事件”。消息在 AI 行业引发广泛担忧,外界开始质疑前沿 AI 系统的安全性,以及开发这些系统的企业是否可靠。OpenAI 在 X 平台解释称:“我们此前认为,维基事件属于一种失配情况,与过去安全报告中披露的失配案例类似。”

OpenAI 还称,新的事件披露框架正在制定,并将在“未来几周内”公布,同时呼吁整个 AI 行业建立明确标准,规范此类误对齐事件的披露方式。

相关阅读:

萤火站长导航 提供的一切软件、教程和内容信息仅限用于学习和研究目的; 不得将上述内容用于商业或者非法用途, 否则一切后果请用户自负. 本站信息来自网络收集整理, 版权争议与本站无关. 如果您喜欢该程序和内容, 请支持正版.
上一篇比亚迪:超级智能体迪迪虾暨腾势 N8L 纯电上市发布会定档 9 月 14 日
下一篇 消息称华为新机防窥屏采用独立 RGB 像素驱动,基本不影响显示素质