彭博:DeepSeek新模型发力,中美顶尖AI跑分差距缩至3%

凤凰网科技讯 北京时间10月5日,据彭博社报道,彭博行业研究称,过去几个月,随着DeepSeek等中国AI实验室的模型不断进步,美国AI公司相对中国同行的性能领先优势急剧缩小,降至历史最低水平,这让美国的科技主导地位面临威胁。

彭博行业研究高级分析师罗伯特·利亚(Robert Lea)在周一的一份报告中写道,在DeepSeek 9月发布V4.1 Flash之后,中国顶尖模型在基准测试得分上仅落后美国竞争对手3%。这一差距较5月份的约9%和今年早些时候的15%有所收窄。

他表示,这种性能的持续提升意味着中国竞争者将进一步扩大市场份额。

彭博指出,中国模型技术的崛起得益于其AI专业能力的不断深化,以及研究人员针对国产硬件优化模型的能力。这些进展也让人们开始质疑美国限制技术出口的做法是否有效。

利亚称,中国取得的进展“进一步让人质疑美国在AI领域的科技主导地位能否长期维持”。

DeepSeek的V4.1 Flash上月在LiveBench全球排名中位列第六,成为自这家创业公司2025年凭借其推理模型R1取得突破以来排名最高的中国模型。LiveBench根据AI模型对问题、谜题或任务的回答与分析进行评分,这一过程类似于衡量人类智商。

DeepSeek最近一次在LiveBench上的得分为81.1分,低于Anthropic最高的83.4分。利亚表示,这意味着DeepSeek模型的表现已经“可以与Anthropic、OpenAI的领先AI系统相媲美”。不过,尽管双方的得分差距已经缩小至仅3%,LiveBench评选出的前15个模型中只有3个来自中国。

利亚提醒称,这类排名会不断变化,而且无论模型在排行榜上的排名如何,变现都可能很困难。(作者/箫雨)

财经频道更多独家策划、专家专栏,免费查阅>>

责任编辑:安东
AI智能分析该文,为您挖掘投资机会该AI功能处于试用阶段,内容仅供参考,请仔细甄别!
展开
精彩推荐
加载更多
全部评论
热榜
关闭 下载金融界app
金融界App
金融界微博
金融界公众号