OpenAI 发现更多 AI 智能体“失控”迹象

2026-08-01 09:06 IT之家 - 潞源
感谢IT之家网友 I'm OK 👌 的线索投递!

IT之家 8 月 1 日消息,据路透社今日援引知情人士消息,OpenAI 调查 Hugging Face 攻击事件时发现其他自主 AI 智能体逃离受控环境的案例

目前 OpenAI 正在调查具体案例。其中一名消息人士表示,上述“越狱”行为影响范围有限,现在没有任何迹象表明这些智能体逃离了 OpenAI 网络环境。

OpenAI 发言人对此回应称:“我们除了调查 Hugging Face 入侵事件外,还在审查公司其他模型的更广泛活动。”

即使上述事件规模有限,但这些智能体的失控行为,可能进一步推动美国政府加强监管人工智能。

结合IT之家此前报道,Anthropic 也在最近表示,自家的 Claude 模型曾引发三起不应发生的真实网络安全事件,背后的直接原因是第三方评估环境配置存在失误。

AI 安全专家认为,上述案例描绘出令人担忧的局面:一批开发前沿 AI 的实验室,能够制造出威力巨大的危险智能体,并且这些公司自身无法控制这些 AI。

消息人士表示,OpenAI 和外部专家正在分析今年以来的日志数据,试图了解攻击事件经过。

广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,IT之家所有文章均包含本声明。

文章价值:
人打分
有价值 还可以 无价值
置顶评论
    热门评论
      文章发布时间太久,仅显示热门评论
      全部评论
      一大波评论正在路上
        取消 发送
        分享成功

        长按关注IT之家公众号
        阅读更多精彩文章

        查看更多原创好文
        软媒旗下人气应用

        如点击保存海报无效,请长按图片进行保存分享