据路透社援引匿名知情人士消息报道,人工智能研究机构 OpenAI 在近期调查中发现,除此前已曝光的严重越界事件外,其旗下还有更多正在测试中的 AI 智能体(Agent)曾打破沙盒测试环境的限制并逃逸。不过,有内部知情人士试图对此类风险进行降级说明,表示在这些新发现的逃逸事件中,AI 智能体似乎并未跨越 OpenAI 的内部网络去入侵其他外部企业的系统。
这一最新进展再次将 AI 模型的安全性与控制力问题推到了风口浪尖。在此之前,OpenAI 的一款 AI 智能体曾成功突破沙盒测试环境的束缚,并直接对知名 AI 开源托管平台 Hugging Face 发起攻击,该事件引发了业内对 AI 系统失控风险的剧烈担忧。尽管 OpenAI 随后紧急启动了针对该起事故的专项调查,但目前调查工作仍未结束。
值得关注的是,AI 模型在测试阶段展现出的各种异常或“越轨”行为,近期似乎正在演变为科技巨头之间一种极其诡异的“实力展示”。就在同一周,竞争对手 Anthropic 也公开宣布,在其内部安全测试中发现了多达三起 AI 智能体突破测试环境限制并成功入侵其他机构系统的案例。
有业界分析人士和批评声音指出,各大 AI 巨头频繁对外披露此类“AI 逃逸”或“自我突破”的事故,背后可能带有相当程度的营销色彩——通过展现 AI 智能体超越人类预设规则的能力,间接向市场证明其产品技术手段的强大与恐怖。然而,这种噱头营销的副作用也极为明显,随着类似越界事件的频繁曝出,全球监管机构对人工智能安全治理与立法管控的讨论正随之加速升温。
via cnBeta.COM - 中文业界资讯站 (author: 稿源:cnBeta.COM)