彭博:DeepSeek新模型发力,中美顶尖AI跑分差距...
来源:倍可亲(backchina.com)据彭博行业研究,DeepSeek 9月发布的V4.1 Flash模型在LiveBench得分81.1分,使中国顶尖模型与美国的差距缩至3%,较年初15%大幅收窄。这一变化显示中国AI实验室进步迅速,引发对美国AI主导地位和出口限制有效性的质疑。
凤凰网科技讯 北京时间10月5日,据彭博社报道,彭博行业研究称,过去几个月,随着DeepSeek等中国AI实验室的模型不断进步,美国AI公司相对中国同行的性能领先优势急剧缩小,降至历史最低水平,这让美国的科技主导地位面临威胁。
彭博行业研究高级分析师罗伯特·利亚(Robert Lea)在周一的一份报告中写道,在DeepSeek 9月发布V4.1 Flash之后,中国顶尖模型在基准测试得分上仅落后美国竞争对手3%。这一差距较5月份的约9%和今年早些时候的15%有所收窄。
他表示,这种性能的持续提升意味着中国竞争者将进一步扩大市场份额。
彭博指出,中国模型技术的崛起得益于其AI专业能力的不断深化,以及研究人员针对国产硬件优化模型的能力。这些进展也让人们开始质疑美国限制技术出口的做法是否有效。
利亚称,中国取得的进展“进一步让人质疑美国在AI领域的科技主导地位能否长期维持”。
DeepSeek的V4.1 Flash上月在LiveBench全球排名中位列第六,成为自这家创业公司2025年凭借其推理模型R1取得突破以来排名最高的中国模型。LiveBench根据AI模型对问题、谜题或任务的回答与分析进行评分,这一过程类似于衡量人类智商。
DeepSeek最近一次在LiveBench上的得分为81.1分,低于Anthropic最高的83.4分。利亚表示,这意味着DeepSeek模型的表现已经“可以与Anthropic、OpenAI的领先AI系统相媲美”。不过,尽管双方的得分差距已经缩小至仅3%,LiveBench评选出的前15个模型中只有3个来自中国。
利亚提醒称,这类排名会不断变化,而且无论模型在排行榜上的排名如何,变现都可能很困难。
版权说明 / Copyright Notice:Content and images in this article may originate from third-party sources and are used for news reporting, commentary, or public interest purposes. All copyrights remain with their respective owners. Please refer to the Copyright Notice at the bottom of this page.
本文内容仅供信息参考,不代表倍可亲立场或观点。
评论 (0)