大模型产业格局研判 · 2026—2029
数据,
是下一道护城河。
迭代、格局,与百度的选择
问题一 · 迭代会不会变慢
不会变慢。只要 Scaling Law 还在。
投入的算力和数据每多一个数量级,模型就稳定地强一截。这条规律还没有失效。
×5 / 年
前沿大模型的训练算力,2020 年以来每年的增速
≈4 个月
AI 能独立完成的任务长度翻一倍;过去要 7 个月
亿美元
美国六家云巨头 2026 年的资本开支,2027 年接近 1 万亿
微软亚马逊GoogleMeta甲骨文CoreWeave
2017 年,百度硅谷实验室就用论文验证过这条规律:训练数据越多,误差按幂律稳定下降。
可能让它慢下来的不是技术,而是 2028 年前后的电和钱。
03
问题一 · 中国会不会慢下来
电,恰恰是中国的长板;短板在芯片。
Scaling 吃三样:电、芯片、数据。前两样决定跑多快,第三样决定谁跑在前面。
电中国的长板
2 倍多
2025 年中国用电量 10.37 万亿千瓦时,
是美国的两倍多
约 倍
新增发电装机:中国 5.5 亿千瓦,
美国约 5300 万千瓦(2025 年)
黄仁勋:“中国的能源是我们的两倍。”
马斯克:“AI 的限制因素,根本上是电力。”
芯片中国的短板
英伟达的中国数据中心收入已按零计算
数据决定谁跑在前面
“我们只有
一个互联网。”
伊利亚·苏茨克维(OpenAI 联合创始人),
2024 年 12 月:公开数据已经见顶
下一段 Scaling,拼的是别人拿不到的数据。
所以中国的模型不会因为缺电慢下来;要补的是芯片,要抢的是数据。
04
问题一 · 落到发布节奏上
模型一个月一更,领先只有一个季度。
5 代
Anthropic 今年发布的旗舰 Opus
05
问题二 · 有竞争力的是多家还是少数
少数几家。前沿是寡头,而且越来越集中。
但座次一年一换;中美是两个圈,彼此很少交叉。
前三家拿走近九成
美国企业 API 支出 · 前三家 88%
40%27%21%
AnthropicOpenAIGoogle其他
中国模型 API(MaaS)· 前三家近九成
49.5%28%10%
火山引擎阿里云百度智能云
座次一年一换
全球 AI 网站访问份额
企业 API 份额(2023→2025):
OpenAI 50% → 27%,Anthropic 12% → 40%
中美两个圈
芯片已经分开,模型很少交叉
≈1%
中国开源模型在美国企业 API 用量中的占比
0
英伟达下季度收入指引里,中国数据中心收入按零计算
那为什么越来越集中?
06
问题二 · 为什么越来越集中
卡、钱、数据,都在大公司手里。
全球看卡:美国领先,首先靠卡。国内看钱和卡:小公司跟不上。大公司还有用户,飞轮转得起来。
5%
中国公司合计拥有的全球 AI 算力,比美国任何一家云巨头都少;Google 一家约占 25%
3800亿元+
阿里的 AI 基建投入,吴泳铭说还会远超;
零一万物退出超大模型预训练,百川转做医疗
3.82亿
豆包月活,靠字节的流量一年 +172%;DeepSeek 模型很强,月活却 -20%
大公司
用户
数据
模型
收入
卡
越转越快
新公司、小公司
缺用户
拿不到数据
模型做不好
收入不够
买不起卡
转不起来
卡和钱,决定谁能上桌;数据,决定谁能坐稳。
07
问题三 · 芯、云、模、体,谁主导
赢的是芯、云、模、体都有的整合者。
单看每一层:利润在芯,风险在云,增长在模,控制权在体。只占一层,只能拿到一部分。
芯
利润最多
亿美元
英伟达一个季度的营业利润,毛利率 75%
(截至 2026 年 7 月)
云
风险最大
钱是云先垫的:六家云巨头今年的投入,
约是整个生成式 AI 市场一年的 4 倍;收入跟不上,亏的是云
模
增长最快
×3.5
OpenAI 与 Anthropic 年化收入 8 个月的增幅,
但开源只落后约 4 个月
体
控制权所在
亿美元
Anthropic 办公智能体发布插件后,全球软件股单日蒸发;
SpaceX 以 600 亿美元收购编程智能体 Cursor
所以,模型公司都在往两头扩:一头锁算力,一头做智能体
OpenAI
GPT
博通定制芯片
ChatGPT、Codex、Dots
Anthropic
Claude
锁定 3.5GW TPU
Claude Code、Cowork
Google
Gemini
TPU、谷歌云
搜索、安卓四层本来都有
08
问题三 · 为什么是整合者
芯片和模型是根,云和体把它们放大。
整合者赢在闭环:芯片压成本,模型定上限;云把算力变成收入,体把能力变成用户和数据。
≈44%
成本:自己的芯片更便宜
Google 自用 TPU 的总成本,比英伟达 GB200
低约 44%;买英伟达,就要付 75% 的毛利
5 天
可控:自己的模型不怕断供
Windsurf 的模型依赖 Anthropic,Anthropic 提前
不到 5 天通知,就切断了它对 Claude 的直连
10 亿
闭环:一家做全,飞轮转得最快
Gemini 用 TPU 训练、谷歌云承载,
安卓和搜索分发,月活破 10 亿
对百度:四层都有;最该加码的,是两个根——昆仑芯和文心。
09
从三个问题,到主线
三个答案,都指向同一样东西。
问题一 · 迭代不会慢Scaling 还要吃更多数据,公开的快用完了
问题二 · 越来越集中大公司手里,攒着最多的数据
问题三 · 整合者赢智能体和终端,把用户和数据带回来
今天的主线,就是
数据。
10
主线 · 为什么是数据
Scaling 谁都会,数据不是谁都有。
卡能堆,训练时间也能堆;难的,是持续拿到别人拿不到的高质量数据,这要靠找数据的本事。
数据的三个好处
1
让模型更强
Scaling 的燃料。算力能买,公开数据快用完了;
独有的数据,就是独有的能力。
2
让体验更好
专业 know-how 让它更准,个人数据让它更懂你。
3
让领先变成复利
体验越好,用户越多,数据越多;晚来的,追不上。
百度的底子:大量高质量数据,和找数据的本事
11
主线 · 两种数据
护城河,是别人拿不到的两种数据。
专业场景的 know-how
让模型会做专业的事
怎么判断、怎么做、做对没有——只在场景里。
工业设备怎么诊断,工艺参数怎么调
法律案子怎么判,合同哪里有坑
金融风险怎么判,钱该怎么投
百度在场:搜索、自动驾驶、文库、AI 办公
个人数据
让智能体更懂你
日程、偏好、会议,去过哪,见过谁。
越积越多:用得越久,越懂你
万亿 token
公开人类文本存量,2026—2032 年间用完
1.5—2 小时
Cursor 用真实使用数据训练出一版新模型
亿美元
专家数据公司 Mercor 的年化收入(2026 年 6 月)
12
入口一 · 智能体
智能体分两种,攒下两种数据。
办公 / Coding 智能体在工作里攒 know-how;个人智能体在生活里攒个人数据。
办公 / Coding 智能体
业务生产力场景
攒下:专业 know-how
500 万+
Codex 每周用户,是 2 月的 6 倍多;
五分之一已经不是程序员
Claude Code年化收入约 25 亿美元
CursorSpaceX 作价 600 亿美元收购
百度库库AIAI 办公月活 2500 万+
个人智能体
个人提效、生活场景
攒下:个人数据
10 亿+
Gemini 应用月活;Google 已经打通
Gmail、相册和搜索记录
OpenAI Dots常驻后台,自带云端电脑
字节豆包手机助手
百度搭子日均提问涨 20 倍
两个入口,两种数据,都要占。
OpenAI 两条线都在做:Dots 替你盯着事,Codex 写代码、做分析;10 月 9 日起,Dots 可以直接把活派给 Codex。
13
入口一 · 个人智能体
个人智能体,是搜索的下一种形态。
以后用户有事,先找自己的智能体。
问点什么,或者交给搭子去办
下周去上海见客户,帮我安排一下
搭子 · 已为你办好 3 件事
✓周二 08:00 高铁,已出票
✓静安区酒店 2 晚,已预订
✓客户会议已加进日程,并提醒了对方
2026 年,大家都在抢这个入口
2025.12Meta 收购 Manus
2026.01Google:Gemini 打通个人数据
2026.07百度:搭子提问量涨 20 倍
2026.09.16字节:豆包手机助手开卖
2026.09.29OpenAI:常驻后台的 Dots
数据跟着入口走。
障碍也真实存在:豆包手机助手在微信、淘宝里至今不能自动操作——模型能解决“会不会做”,解决不了“让不让做”。
14
入口二 · 硬件
耳机:感知真实世界,建议就在耳边。
感知
更全面地获取
现实世界的多模态数据
语音、环境声、动作,
结合手机位置等上下文
建议
在用户耳边,
及时提供建议
翻译、提醒、行动提示,
不必持续看屏
小度知音个人智能体耳机提案
为什么是百度
做过硬件,也做过耳机小度音箱、智能屏已有落地
2020 年已推出真无线智能耳机
语音交互能接上文心识别、理解、合成与工具调用
可支撑“随口问、耳边答”
搜索与地图可以复用查信息、找地点、规划路线
让回答接到具体服务
为什么先选耳机
已有习惯,更易尝试听歌、通话先有价值,
减少学习成本
语音为主,可扩展感知结合佩戴 / 运动信号
及手机上下文
帮助就在耳边免看屏、少占双手,
适合翻译与短提示
能听,也能回应说出需求、听取建议、
确认下一步
先做好耳机,再验证 AI 价值;耳机负责交互,手机与云端承接复杂任务。
15
时间表 · 看三年
2028 年,是检验点。
电、钱、公开数据,都在 2028 年前后到头:靠堆算力往前冲的路,会同时变窄。
2026—2027
2028
2029—2030
抢位期
检验点
定型期
谁先成为默认的智能体,谁先攒数据
格局定型:谁是“操作系统”见分晓
电美国缺三分之一
32GW
到 2028 年美国数据中心的缺电量,
自建电厂也补不上。中国不缺电,缺卡。
钱要开始看到回报
1220亿美元
OpenAI 3 月融的钱,按计划 2028 年花完;
云巨头一年要投近 1 万亿美元。
数据公开的用完
300万亿 token
全世界公开的高质量文本;按现在的用法,用完的中位年份正是 2028 年。
过了 2028,比的不再是谁算得多,而是谁的数据好、谁离用户近。
16
百度的选择
一个模型,两种智能体,走进生活的硬件。
芯和云:昆仑芯 · 百度智能云,压低每办成一件事的成本
1
让文心回到并留在第一梯队
“让文心重新回到基础大模型的第一梯队。”
——李彦宏,2026 年二季度财报电话会
2
智能体:搭子管个人,库库AI 管工作
搭子:一个智能体、一份记忆,接住 6.4 亿月活
库库AI:AI 办公月活 2500 万+,攒下专业 know-how
3
用硬件走进用户的生活
小度守家庭(5500 多万户),小度知音随身
17
影片 · 小度知音的一天
08:30
通勤路上
小度知音
9 点的会提前到 8:50,
资料已经放进你的文件夹。
10:30
办公室
小度知音
库库AI 把竞品报告写好了,
要发给团队吗?
发吧。
12:30
WAIC 展台
小度知音
这位是某公司的产品负责人,
你们上个月邮件聊过合作。
21:00
家里 · 小度
今天,搭子替你办成 6 件事
✓会议改到 8:50,资料已备好
✓竞品报告已发给团队
✓WAIC 上见过的人已整理成名片
✓提醒你买了鸡蛋
✓周二上海出差已安排
✓明早 7:30 叫你起床
记忆随时可看、可删
一直在身边,越用越懂你。
小度知音 × 搭子