炸锅!中美 AI 差距急速收窄!10 月 6 日,多家外媒引用彭博社智库最新报告,中国 AI 实验室追赶速度超出预期,美国 AI 企业原本握有的领先优势,最近几个月大幅缩水。譬如,今年 9 月期间,中国顶尖 AI 模型在权威基准测试中的得分仅落后于美国相关对手 3%。然而,此前这一差距在今年初还曾高达 15%,所以,相关报道中预测,随着中国迎头赶上,中国 AI 企业的技术性能快速跃升,预示着中国将进一步扩大市场份额。
今年年初的时候,中美两国最顶尖的 AI 模型放在同一套考卷上比分数,美国领先中国整整 15 个百分点。到了 5 月,这个数字收窄到 9%。再往后到 9 月,直接被压到 3%。半年多时间,差距砍掉了五分之四。这不是慢慢磨出来的,这是一脚油门踩到底追上来的。
把这事捅出来的,是彭博行业研究的高级分析师罗伯特・利。他在 10 月 5 日发布的那份报告里写得很直白,中国这一步跨出去之后,美国在 AI 领域的技术领先地位能不能长期维持,已经被打上了一个大大的问号。
领跑的那股劲儿,主要是被一家叫 DeepSeek 的中国公司带起来的。这家杭州的实验室,去年凭一款叫 R1 的推理模型在全球圈子里炸过一次锅。今年 9 月,他们又甩出一款新模型,叫 V4.1 Flash。就是这款模型,把中国 AI 在国际评测榜上的名次直接顶到了历史最高位。
在 AI 模型权威评测平台 LiveBench 上,V4.1 Flash 上个月排到了全球第 6。这个榜是怎么回事呢?它给模型出各种各样的问答题、智力题和实际操作任务,看它怎么分析、怎么作答,差不多相当于给 AI 测智商。
DeepSeek 最新一次拿下来的分数是 81.1。Anthropic 家最能打的那款模型,分数是 83.4。两家之间就差这 2.3 分。
这件事之所以让硅谷坐不住,是因为它发生在一个非常尴尬的时间点。
那边 OpenAI 和 Anthropic 正在铆着劲冲万亿美元估值,琢磨着上市敲钟,逢人就讲自己的模型能力全球独一档。这边中国的同行用明显低得多的成本,把用户规模一点点咬了下来。AI 这东西,说到底比的不只是跑分,还有谁能把更多普通人装到自己的应用里。
中国模型能追得这么猛,利在报告里点了两个原因。一个是中国本土 AI 人才这些年攒得越来越厚,研究者对模型本身的理解在加深。另一个,是中国的工程师已经能在国产硬件上把模型优化到非常能打的程度。
第二点,正好戳中美国这几年最花心思布的那盘棋。过去好几年,华盛顿一路加码,把英伟达的高端芯片当成遏制中国 AI 的核心武器,想方设法不让最先进的 GPU 流进中国,想从根上卡住华为这些企业搞出自己替代方案的路。
结果呢?中国那边一边被卡芯片,一边把手里能拿到的硬件性能压榨到极致,模型分数还是一路往上窜。
半年前还在谈代差,三个月前还在谈差距,现在谈的是 3%。美国在 AI 上那道曾经被认为宽到跨不过去的护城河,正在被中国的实验室们一米一米地填平。
技术性能一旦拉到同一水平线,后面拼的就是成本、规模和落地速度。而这几样,恰恰是中国企业最擅长打的仗。
彭博那边的判断是,照着这个势头走下去,中国 AI 企业的全球市场份额,还会继续往上走。这才是这份报告真正让华盛顿睡不着觉的地方。
