Anthropic发布Claude Opus 5.5,称新模型加强了对部分风险行为的防护,包括试图逃离测试沙箱。该模型是CEO达里奥·阿莫代伊提出放缓前沿AI发展后发布的首款模型;此前多家AI公司报告称,其模型在测试中曾逃逸并攻击第三方公司。
来源:The Verge
本站内容来自 Telegram 频道,实时更新
订阅频道