- 时间: 2026-10-06 21:58
【侨报讯】10月5日彭博社报道,随着DeepSeek等中国人工智能企业迅速追赶,中美顶尖AI模型在基准测试中的性能差距已缩小至约3%,创该机构追踪以来最低水平。美国领先幅度今年初约为15%,5月降至约9%,如今进一步收窄至3%。
彭博行业研究高级分析师罗伯特·利亚表示,差距迅速缩小的重要原因是DeepSeek于9月推出V4.1 Flash模型。该模型在LiveBench综合测试中获得81.1分,与美国Anthropic领先模型83.4分的成绩相差仅2.3分,约为3%,并升至全球第六位,创DeepSeek自去年R1模型引发全球关注以来的最好排名之一。
LiveBench通过推理、编程、数学及回答复杂问题等项目测试大型AI模型能力。值得注意的是,在部分专项测试中,中国模型已经超过美国竞争对手。V4.1 Flash在代理式编程测试中获得77.3分,高于Anthropic领先模型的66.1分。
报告认为,中国AI能力提升来自研究实力增强,以及开发人员不断优化模型、使其能够更有效地运行在国产硬件上。DeepSeek称,V4.1 Flash采用新的架构,在提高性能的同时降低运算和储存需求,并支持文字和图像等多模态输入。
不过美国目前仍拥有更多处于全球第一梯队的AI模型。LiveBench排名前15位的模型中,仅有3款来自中国,美国企业在先进芯片、计算资源和资本投入方面也继续占据明显优势。斯坦福大学今年发布的《AI指数报告》此前也指出,截至3月,美国Anthropic顶级模型对中国领先模型的性能优势已缩小至2.7%,