DeepSeek V4.1 Flash 发力,中美顶尖模型 LiveBench 跑分差距缩至3%

彭博行业研究称,DeepSeek等中国AI实验室持续提升模型性能,使中美顶尖模型在基准测试中的差距从年初约15%、5月约9%缩小至3%。DeepSeek V4.1 Flash在LiveBench排名第六,得分81.1分,接近Anthropic和OpenAI的领先模型;分析认为,中国模型可能进一步扩大市场份额,也引发对美国AI主导地位和出口限制有效性的质疑,但模型排名与商业变现仍存在不确定性。

来源:IT之家