大模型产业格局研判 · 2026—2029

数据,
是下一道护城河。

迭代、格局,与百度的选择

2026 年 10 月
问题一 · 迭代会不会变慢

不会变慢。只要 Scaling Law 还在。

投入的算力和数据每多一个数量级,模型就稳定地强一截。这条规律还没有失效。

能力(对数坐标,示意) 2019 2022 2025 2028 只靠堆预训练:收益递减 现在 预训练 几条线一起 Scaling 强化学习 · 推理时多想一会 · 智能体连续工作更久
×5 / 年
前沿大模型的训练算力,2020 年以来每年的增速
≈4 个月
AI 能独立完成的任务长度翻一倍;过去要 7 个月
亿美元
美国六家云巨头 2026 年的资本开支,2027 年接近 1 万亿
微软亚马逊GoogleMeta甲骨文CoreWeave
2017 年,百度硅谷实验室就用论文验证过这条规律:训练数据越多,误差按幂律稳定下降。
可能让它慢下来的不是技术,而是 2028 年前后的电和钱。
来源:Epoch AI(2026-02);METR;穆迪(Fortune,2026-08-20);Hestness 等,百度研究院(2017);曲线为示意
03
问题一 · 中国会不会慢下来

电,恰恰是中国的长板;短板在芯片。

Scaling 吃三样:电、芯片、数据。前两样决定跑多快,第三样决定谁跑在前面。

电中国的长板
2 倍多
2025 年中国用电量 10.37 万亿千瓦时,
是美国的两倍多
约 倍
新增发电装机:中国 5.5 亿千瓦,
美国约 5300 万千瓦(2025 年)
黄仁勋:“中国的能源是我们的两倍。”
马斯克:“AI 的限制因素,根本上是电力。”
芯片中国的短板
几代
黄仁勋:英伟达的芯片仍领先中国几代
第 代
昆仑芯 M100,今年推出的第四代芯片
英伟达的中国数据中心收入已按零计算
数据决定谁跑在前面
“我们只有
一个互联网。”
伊利亚·苏茨克维(OpenAI 联合创始人),
2024 年 12 月:公开数据已经见顶
下一段 Scaling,拼的是别人拿不到的数据。
所以中国的模型不会因为缺电慢下来;要补的是芯片,要抢的是数据。
来源:中电联(第一财经,2026-02-02);EIA(2026-02-20);Fortune(2025-12-06;2026-01-22);同花顺(2026-07-20);NeurIPS 2024
04
问题一 · 落到发布节奏上

模型一个月一更,领先只有一个季度。

4–8 周
头部厂商推出一个新版本
5 代
Anthropic 今年发布的旗舰 Opus
≈4 个月
最强开源模型落后最强闭源模型
来源:LLM Gateway 发布时间线;Epoch AI(2026-05-29);Epoch 能力指数 ECI(2026-10 数据)
05
问题二 · 有竞争力的是多家还是少数

少数几家。前沿是寡头,而且越来越集中。

但座次一年一换;中美是两个圈,彼此很少交叉。

前三家拿走近九成
美国企业 API 支出 · 前三家 88%
40%27%21%
AnthropicOpenAIGoogle其他
中国模型 API(MaaS)· 前三家近九成
49.5%28%10%
火山引擎阿里云百度智能云
座次一年一换
全球 AI 网站访问份额
2025.6 2026.5 76% 9% 2% 53% ChatGPT 27% Gemini 9% Claude
企业 API 份额(2023→2025):
OpenAI 50% → 27%,Anthropic 12% → 40%
中美两个圈
芯片已经分开,模型很少交叉
≈1%
中国开源模型在美国企业 API 用量中的占比
0
英伟达下季度收入指引里,中国数据中心收入按零计算
那为什么越来越集中?
来源:Menlo Ventures(2025-12);IDC(KrASIA);Similarweb(2026 年 5 月);英伟达 2027 财年二季度财报
06
问题二 · 为什么越来越集中

卡、钱、数据,都在大公司手里。

全球看卡:美国领先,首先靠卡。国内看钱和卡:小公司跟不上。大公司还有用户,飞轮转得起来。

卡
全球看:美国领先,首先靠卡
5%
中国公司合计拥有的全球 AI 算力,比美国任何一家云巨头都少;Google 一家约占 25%
钱
国内看:做大模型,小公司跟不上
3800亿元+
阿里的 AI 基建投入,吴泳铭说还会远超;
零一万物退出超大模型预训练,百川转做医疗
数据
大公司已经攒了多年
3.82亿
豆包月活,靠字节的流量一年 +172%;DeepSeek 模型很强,月活却 -20%
大公司
用户
数据
模型
收入
卡
越转越快
新公司、小公司
缺用户
拿不到数据
模型做不好
收入不够
买不起卡
转不起来
卡和钱,决定谁能上桌;数据,决定谁能坐稳。
来源:Epoch AI(2026-04-06,截至 2025 年底,不含走私芯片和海外租用的算力);财联社(2026-05-13);虎嗅;QuestMobile(2026-06)
07
问题三 · 芯、云、模、体,谁主导

赢的是芯、云、模、体都有的整合者。

单看每一层:利润在芯,风险在云,增长在模,控制权在体。只占一层,只能拿到一部分。

芯
利润最多
亿美元
英伟达一个季度的营业利润,毛利率 75%
(截至 2026 年 7 月)
云
风险最大
投入亿美元
市场约 2000亿美元
钱是云先垫的:六家云巨头今年的投入,
约是整个生成式 AI 市场一年的 4 倍;收入跟不上,亏的是云
模
增长最快
×3.5
OpenAI 与 Anthropic 年化收入 8 个月的增幅,
但开源只落后约 4 个月
体
控制权所在
亿美元
Anthropic 办公智能体发布插件后,全球软件股单日蒸发;
SpaceX 以 600 亿美元收购编程智能体 Cursor
所以,模型公司都在往两头扩:一头锁算力,一头做智能体
OpenAI
GPT
博通定制芯片
ChatGPT、Codex、Dots
Anthropic
Claude
锁定 3.5GW TPU
Claude Code、Cowork
Google
Gemini
TPU、谷歌云
搜索、安卓四层本来都有
来源:英伟达 2027 财年二季度财报;穆迪(Fortune);Epoch AI;Outlook Business;Engadget
08
问题三 · 为什么是整合者

芯片和模型是根,云和体把它们放大。

整合者赢在闭环:芯片压成本,模型定上限;云把算力变成收入,体把能力变成用户和数据。

根
放大器
芯
成本和供给
模
能力的上限
云
把算力变成收入
体
把能力变成用户和数据
放大 收入养芯片 放大 数据喂模型
≈44%
成本:自己的芯片更便宜
Google 自用 TPU 的总成本,比英伟达 GB200
低约 44%;买英伟达,就要付 75% 的毛利
5 天
可控:自己的模型不怕断供
Windsurf 的模型依赖 Anthropic,Anthropic 提前
不到 5 天通知,就切断了它对 Claude 的直连
10 亿
闭环:一家做全,飞轮转得最快
Gemini 用 TPU 训练、谷歌云承载,
安卓和搜索分发,月活破 10 亿
对百度:四层都有;最该加码的,是两个根——昆仑芯和文心。
来源:SemiAnalysis,经 The Decoder(2025-11-29);英伟达 2027 财年二季度财报;TechCrunch(2025-06-03);Google(2026-08-11)
09
从三个问题,到主线

三个答案,都指向同一样东西。

问题一 · 迭代不会慢Scaling 还要吃更多数据,公开的快用完了
问题二 · 越来越集中大公司手里,攒着最多的数据
问题三 · 整合者赢智能体和终端,把用户和数据带回来
今天的主线,就是 数据。
10
主线 · 为什么是数据

Scaling 谁都会,数据不是谁都有。

卡能堆,训练时间也能堆;难的,是持续拿到别人拿不到的高质量数据,这要靠找数据的本事。

能力(示意) 时间 各家都在堆卡、堆训练时间 + 别人拿不到的数据
数据的三个好处
1
让模型更强
Scaling 的燃料。算力能买,公开数据快用完了;
独有的数据,就是独有的能力。
2
让体验更好
专业 know-how 让它更准,个人数据让它更懂你。
3
让领先变成复利
体验越好,用户越多,数据越多;晚来的,追不上。
百度的底子:大量高质量数据,和找数据的本事
万+
百度百科词条(2026 年 1 月)
18 亿+
百度文库的专业文档
3.5 亿公里
萝卜快跑的自动驾驶里程
26 年
做搜索:知道去哪找数据、怎么分好坏
来源:新京报(2026-01-06);南都 N 视频(2026-01-24);百度 2026 年二季度财报(同花顺,2026-08-19);曲线为示意
11
主线 · 两种数据

护城河,是别人拿不到的两种数据。

专业场景的 know-how
让模型会做专业的事
怎么判断、怎么做、做对没有——只在场景里。
工业设备怎么诊断,工艺参数怎么调
法律案子怎么判,合同哪里有坑
金融风险怎么判,钱该怎么投
百度在场:搜索、自动驾驶、文库、AI 办公
个人数据
让智能体更懂你
日程、偏好、会议,去过哪,见过谁。
越用越懂你
越积越多:用得越久,越懂你
万亿 token
公开人类文本存量,2026—2032 年间用完
1.5—2 小时
Cursor 用真实使用数据训练出一版新模型
亿美元
专家数据公司 Mercor 的年化收入(2026 年 6 月)
来源:Epoch AI;Cursor;Startup Fortune;示意曲线不代表具体数值
12
入口一 · 智能体

智能体分两种,攒下两种数据。

办公 / Coding 智能体在工作里攒 know-how;个人智能体在生活里攒个人数据。

办公 / Coding 智能体
业务生产力场景
攒下:专业 know-how
500 万+
Codex 每周用户,是 2 月的 6 倍多;
五分之一已经不是程序员
Claude Code年化收入约 25 亿美元
CursorSpaceX 作价 600 亿美元收购
百度库库AIAI 办公月活 2500 万+
个人智能体
个人提效、生活场景
攒下:个人数据
10 亿+
Gemini 应用月活;Google 已经打通
Gmail、相册和搜索记录
OpenAI Dots常驻后台,自带云端电脑
字节豆包手机助手
百度搭子日均提问涨 20 倍
两个入口,两种数据,都要占。
OpenAI 两条线都在做:Dots 替你盯着事,Codex 写代码、做分析;10 月 9 日起,Dots 可以直接把活派给 Codex。
来源:OpenAI(2026-06-02、09-29、10-09);Claude Code 统计(2026-02);Engadget;凤凰网科技(2026-08-14);Google(2026-08-11);科技日报
13
入口一 · 个人智能体

个人智能体,是搜索的下一种形态。

以后用户有事,先找自己的智能体。

问点什么,或者交给搭子去办
下周去上海见客户,帮我安排一下
搭子 · 已为你办好 3 件事
✓周二 08:00 高铁,已出票
✓静安区酒店 2 晚,已预订
✓客户会议已加进日程,并提醒了对方
2026 年,大家都在抢这个入口
2025.12Meta 收购 Manus
2026.01Google:Gemini 打通个人数据
2026.07百度:搭子提问量涨 20 倍
2026.09.16字节:豆包手机助手开卖
2026.09.29OpenAI:常驻后台的 Dots
数据跟着入口走。
障碍也真实存在:豆包手机助手在微信、淘宝里至今不能自动操作——模型能解决“会不会做”,解决不了“让不让做”。
来源:SiliconANGLE;DataCamp;TechRadar;科技日报;每日经济新闻
14
入口二 · 硬件
耳机:感知真实世界,建议就在耳边
更全面地获取现实世界的多模态数据
语音、环境声、动作,结合手机位置等上下文
在用户耳边,及时提供建议
翻译、提醒、行动提示,不必持续看屏
为什么是百度
为什么先选耳机
做过硬件,也做过耳机
小度音箱、智能屏已有落地
2020 年已推出真无线智能耳机
语音交互能接上文心
识别、理解、合成与工具调用
可支撑“随口问、耳边答”
搜索与地图可以复用
查信息、找地点、规划路线
让回答接到具体服务
已有习惯,更易尝试
听歌、通话先有价值,减少学习成本
语音为主,可扩展感知
结合佩戴 / 运动信号及手机上下文
帮助就在耳边
免看屏、少占双手,适合翻译与短提示
能听,也能回应
说出需求、听取建议、确认下一步
小度知音
个人智能体耳机提案
先做好耳机,再验证 AI 价值;耳机负责交互,手机与云端承接复杂任务。
视觉作为后续探索:带摄像头 AirPods 属分析师预测,尚非本次核实的 Apple 已发布能力。
依据:百度世界 2020;百度智能云实时互动;百度地图 MCP;Apple 技术规格;郭明錤分析。产品选择为本项目判断。
15
时间表 · 看三年

2028 年,是检验点。

电、钱、公开数据,都在 2028 年前后到头:靠堆算力往前冲的路,会同时变窄。

2026—2027
2028
2029—2030
抢位期
检验点
定型期
谁先成为默认的智能体,谁先攒数据
格局定型:谁是“操作系统”见分晓
电美国缺三分之一
32GW
到 2028 年美国数据中心的缺电量,
自建电厂也补不上。中国不缺电,缺卡。
钱要开始看到回报
1220亿美元
OpenAI 3 月融的钱,按计划 2028 年花完;
云巨头一年要投近 1 万亿美元。
数据公开的用完
300万亿 token
全世界公开的高质量文本;按现在的用法,用完的中位年份正是 2028 年。
过了 2028,比的不再是谁算得多,而是谁的数据好、谁离用户近。
来源:摩根士丹利(2026-10-05,经 Igor's Lab);金融时报(2026-09,经 Tom's Hardware);穆迪(Fortune,2026-08-20);Epoch AI
16
百度的选择

一个模型,两种智能体,走进生活的硬件。

智能飞轮 懂你飞轮
需求入口
搜索 · 百度 App · 小度知音
搭子
一个智能体,一份记忆
专业 know-how
库库AI 办公、搭子办事
文心更会办事
know-how 回流训练
个人数据(记忆)
小度知音、小度、网盘、地图
文心更懂用户
记忆回流,搭子更主动
芯和云:昆仑芯 · 百度智能云,压低每办成一件事的成本
1
让文心回到并留在第一梯队
“让文心重新回到基础大模型的第一梯队。”
——李彦宏,2026 年二季度财报电话会
2
智能体:搭子管个人,库库AI 管工作
搭子:一个智能体、一份记忆,接住 6.4 亿月活
库库AI:AI 办公月活 2500 万+,攒下专业 know-how
3
用硬件走进用户的生活
小度守家庭(5500 多万户),小度知音随身
来源:百度 2026 年二季度财报(澎湃新闻);新华网;凤凰网科技(2026-08-14)
17
影片 · 小度知音的一天
08:30
通勤路上
小度知音
9 点的会提前到 8:50,
资料已经放进你的文件夹。
10:30
办公室
小度知音
库库AI 把竞品报告写好了,
要发给团队吗?
份
搜集资料
个
核对数字
页
写成报告
发吧。
12:30
WAIC 展台
小度知音
这位是某公司的产品负责人,
你们上个月邮件聊过合作。
18:00
回家路上
小度知音
早上你说要买鸡蛋,
前面路口左转有超市。
21:00
家里 · 小度
今天,搭子替你办成 6 件事
✓会议改到 8:50,资料已备好
✓竞品报告已发给团队
✓WAIC 上见过的人已整理成名片
✓提醒你买了鸡蛋
✓周二上海出差已安排
✓明早 7:30 叫你起床
新记住:你更喜欢靠窗的座位 删除
记忆随时可看、可删
一直在身边,越用越懂你。
小度知音 × 搭子

领先会被追上,

数据不会。

00:00
→ 下一页 ← 上一页 F 全屏 N 讲稿 R 重播