彭博行业研究:中美顶尖模型基准分差收窄至 3%,中国 AI 产业整体盈利预计 2030 年
彭博行业研究(BI)高级分析师 Robert Lea 在 2026-10-05 的报告中称,中国顶尖模型在基准测试上仅落后美国对手 3%,为有记录以来最低;今年初该差距约 15%,5 月约 9%。收窄发生在 DeepSeek 9 月发布 V4.1 Flash 之后——该模型在 LiveBench 全球排第六,得分 81.1,Anthropic 最高分 83.4,是 DeepSeek 自 2025 年 R1 以来排名最高的中国模型。
Lea 把追赶归因于两点:中国实验室的技术积累,以及针对国产硬件优化模型的能力。他认为这进一步让人质疑「美国技术领先能否长期维持」,也令英伟达芯片出口管制的实际效果被打上问号。报告同时对照了双方的不同算盘:中国模型正以低成本在用户数上追近,Anthropic 与 OpenAI 则在以高估值冲刺上市,两边讲的是不同的故事。
报告也给出三条反面事实:LiveBench 前 15 名中仅 3 款中国模型;中国 AI 行业可能到 2030 年才能整体盈利,市场上有逾 1,100 个大模型、token 价格战激烈;变现领先的只有字节的豆包,DeepSeek 与腾讯的聊天机器人仍免费。Lea 的结论是,在 1,100 多个模型的红海里,价格战让任何一家都难以建立持久优势,中国 AI 产业走向可持续盈利「需要竞争降温、行业洗牌和更理性的定价」。
观点
- 3% 是榜单分差的收敛,不是商业份额的收敛。 前 15 只占 3 席、赚钱的只有豆包一家,说明中国模型的优势仍集中在低成本 token 供给,尚未转化为定价权。
- 出口管制反向逼出了国产适配能力。 报告把「针对本土硬件优化」列为追赶主因——管制压低了单卡性能,却加快了算法与工程层面的替代节奏。
- 价格战与 1,100 个模型是同质化的结果,也是盈利的障碍。 当能力差距小到用户无法感知,竞争就退回到渠道与生态嵌入。
- 「模型蒸馏」指控与潜在禁令是下半年最需跟踪的变量,这是把技术追赶转化为市场准入限制的主要抓手。
