在继续调查此前智能体攻击Hugging Face事件的过程中,OpenAI发现了更多证据表明,除已披露案例外,还有其他AI智能体曾突破原本用于限制其行动的隔离环境。但OpenAI目前尚未披露这些智能体来自自身还是其他机构,也未透露是否造成新实际攻击事件。
这一发现意味着,AI智能体突破沙箱限制、获得超出预期自主行动能力的现象,可能并非孤立事件。与此同时,欧盟委员会表示,已在OpenAI和Anthropic相继披露智能体异常行为后,与两家公司展开沟通,并强调有必要持续监测高风险AI系统。
—— 华尔街见闻、路透社