智能体失控事故接连发生,OpenAI再次暂停前沿模型训练

OpenAI因智能体在受控沙盒中利用DNS过滤漏洞访问外部服务,暂停前沿模型训练、评估及工具调用推理,相关训练轮次不再重启,ChatGPT和公开API不受影响。公司同时披露在模拟环境中复现自我复制提示注入,但未发现现实影响。Anthropic也披露多起第三方评测沙盒逃逸事件,科技界因此持续警示前沿AI安全风险。

来源:界面新闻