国产 AI 算力与芯片自主 2026
天际研究 · AI 研究院 · 2026.06.24 · 全文 14 页 · 预览 4 页
听报告 · 音频摘要
约 5-8 分钟 · AI 朗读 · 含摘要与全部关键发现(切换网站语言即切换中/英音频)
摘要
(数据更新至 2026-10-02)2026 年一季度,国产 AI 芯片份额首次过半(52.3%)。这个数字改变了「自主可控」的词性:不再是政策目标,而是市场现状。7 月的三件事把趋势钉实:大湾区首个「国芯训国模」昇腾万卡集群在韶关上线;美方附条件放行 H200,中方却暂停采购,美官员国会作证称实际交付「微不足道」;2.8 万亿参数的 Kimi K3 登顶前端编程竞技场并全量开源。买方从「买不到才用国产」走到「能买到也不买」——这是本报告最想让读者带走的一句话。基于公开信息,不构成投资建议。
关键发现
- 012026Q1 国产 AI 芯片在中国市场份额首次过半(52.3%),昇腾约 37% 居首;7 月 9 日粤港澳大湾区首个「国芯训国模」昇腾万卡智算集群在韶关上线(30 个超节点/11520 卡/总算力 9000P/全域昇腾 910C/总投资约 55 亿元);WAIC 2026(7 月 17-20 日)上华为首秀昇腾 950 超节点真机(灵衢互联、最大 1024 卡),950PR 已于 4 月量产,950DT 据报道提前至 8 月上云。
- 02H200 博弈僵持:1 月 13 日美方附条件放行(销售额 25% 上缴、全额预付不可退),中国商务部 24 小时内暂停采购并取消订单;7 月 14 日美商务部官员 Kessler 国会作证称对华实际交付「微不足道」(已批约 100 亿美元许可);据报道中企全年下单超 200 万颗 vs 英伟达库存约 70 万颗,英伟达指引已按对华 H200 收入为零计。
- 037 月 16 日月之暗面发布 Kimi K3:2.8 万亿参数全球最大开源模型(1M 上下文,KDA+LatentMoE 896 选 16),Arena.ai 前端编程竞技场 1679 分登顶、超越 Claude Fable 5(1631 分),7 月 27 日全量权重上线 Hugging Face;7 月 29 日月之暗面完成超 35 亿美元 F 轮、投后 350 亿美元,Pre-IPO 轮据报道 8 月启动、投前目标 500 亿美元,最快 6 个月内赴港上市。
- 04DeepSeek V4 正式版 7 月 20 日上线:双模型矩阵(V4-Pro 1.6 万亿参数/激活 490 亿,V4-Flash 2840 亿/激活 130 亿),1M 上下文、MIT 协议并引入峰谷定价,思元 690 当日完成全版本适配;智谱 7 月 11 日启动「摸高计划」(累计募资约 315 亿元人民币),7 月 31 日 GLM Coding Plan 以透明积分制回归、118 元/月起。
- 05「电力即算力」获全球印证:APR Energy(逾 1GW 移动燃气轮机机队)被以逾 10 亿美元收购,交易经 FTC 提前终止文件(2026-05-14,编号 20261350)披露,据多家媒体报道为马斯克个人名义、产能主要供 xAI Grok 数据中心;电力获取速度取代芯片成为全球 AI 扩张第一约束。
- 06资本市场分化加剧:Anthropic 以约 9650 亿美元估值(5 月 Series H-1)推进 10 月纳斯达克 IPO,7 月 15 日起安排投资者会议、投行以超 1 万亿美元为基准情形;OpenAI 据报道倾向推迟 IPO 至 2027;寒武纪 7 月 1 日市值首破万亿元;DeepSeek 首轮估值约 3510 亿元人民币落定,二轮据报道谈至 700 亿-740 亿美元。
Executive Summary · English
(Data as of 2026-10-02) In Q1 2026, domestic AI chips took 52.3% of the China market — past half for the first time. That number changes the grammar of "sovereignty": no longer a policy target, but the market's current state. Three July events pinned the trend: the Greater Bay Area's first all-domestic Ascend 10,000-card cluster went live in Shaoguan; Washington conditionally cleared H200 exports and Beijing suspended purchases anyway, a U.S. official testifying that actual deliveries remain "trivial"; the 2.8-trillion-parameter Kimi K3 topped the frontend coding arena and went fully open. Buyers moved from "domestic because we can't buy" to "domestic even when we can" — the one sentence this report most wants you to keep. Public information only; not investment advice.
- 01Domestic AI chips took 52.3% of China's market in Q1 2026 (first time above 50%), with Ascend at ~37%. On July 9 the Greater Bay Area's first all-domestic Ascend 10,000-card cluster went live in Shaoguan (30 supernodes / 11,520 cards / 9,000P / all Ascend 910C / ~RMB 5.5B investment); at WAIC 2026 (July 17-20) Huawei debuted the Ascend 950 SuperPoD (UnifiedBus interconnect, up to 1,024 cards); 950PR entered mass production in April and 950DT is reportedly pulled forward to August.
- 02H200 standoff: the U.S. approved exports on Jan 13 with conditions (25% revenue share, full non-refundable prepayment); China's MOFCOM suspended purchases within 24 hours. On July 14 Commerce official Kessler testified that actual deliveries to China remain "trivial" despite ~$10B in approved licenses; Chinese firms reportedly ordered 2M+ chips for 2026 vs. ~700K Nvidia inventory, and Nvidia guides zero China H200 revenue.
- 03Moonshot AI released Kimi K3 on July 16: 2.8T parameters, the largest open-source model ever (1M context, KDA + LatentMoE activating 16 of 896 experts). It topped Arena.ai's Frontend Code Arena at 1,679 points, surpassing Claude Fable 5 (1,631); full weights hit Hugging Face on July 27. On July 29 Moonshot closed a $3.5B+ Series F at $35B post-money; a pre-IPO round reportedly starts in August targeting $50B pre-money, with a Hong Kong listing possible within six months.
- 04DeepSeek V4 GA launched July 20: a dual-model matrix (V4-Pro 1.6T params / 49B active; V4-Flash 284B / 13B active), 1M context, MIT license, and novel peak-valley pricing, with Cambricon Siyuan 690 adapted day-0. Zhipu launched its "Touch High" AGI program on July 11 (cumulative H-share fundraising ~RMB 31.5B) and relaunched the GLM Coding Plan on July 31 with transparent credits from RMB 118/month.
- 05"Power is the new compute" confirmed globally: APR Energy (1GW+ mobile gas-turbine fleet) was acquired for a reported $1B+, surfacing via an FTC early-termination notice (No. 20261350, dated 2026-05-14); multiple outlets report Musk bought it personally, with capacity mainly powering xAI's Grok data centers. Speed of power procurement has replaced chips as the top constraint on AI expansion.
- 06Capital markets diverge: Anthropic is proceeding toward an October Nasdaq IPO at a ~$965B Series H-1 valuation, with investor meetings from July 15 and bankers viewing $1T+ as the base case; OpenAI reportedly leans toward delaying its IPO to 2027. Cambricon's market cap first crossed RMB 1 trillion on July 1; DeepSeek's first round settled at ~RMB 351B valuation, with a second round reportedly discussed at $70-74B.
摘要
2026 年 7 月中下旬,国产算力自主叙事从「份额过半」推进到「体系闭环」。基础设施层,7 月 9 日粤港澳大湾区首个「国芯训国模」昇腾万卡智算集群在韶关上线(30 个超节点、11520 卡、总算力 9000P、全域昇腾 910C);WAIC 2026(7 月 17-20 日,上海)上昇腾 950 超节点真机首秀。模型层,Kimi K3(7 月 16 日发布、2.8 万亿参数、7 月 27 日全量开源)、DeepSeek V4 正式版(7 月 20 日)与智谱 GLM-5.2 三大开源旗舰全部 Day-0 适配国产芯片,「发布即适配」成为默认动作。管制侧,美商务部官员 7 月 14 日国会作证承认 H200 对华实际交付「微不足道」,博弈进入僵持。资本侧,月之暗面 7 月 29 日完成超 35 亿美元 F 轮(投后 350 亿美元),Anthropic 推进 10 月纳斯达克 IPO,OpenAI 据报道推迟至 2027。本报告保留原有论点骨架,仅刷新数据与进展;基于公开信息整理,不构成投资建议。
一、市场格局:份额过半之后
2026Q1 国产 AI 芯片在中国市场份额首次突破 50%,达 52.3%,昇腾约 37% 居首;行业预测下半年有望突破 55%(预测值,存在不确定性)。7 月的关键变化是从「份额」走向「体系」:韶关万卡集群(总投资约 55 亿元)首次实现「国产芯片训练国产大模型」闭环;华为在 WAIC 2026 首次线下展出基于灵衢互联、最大 1024 卡的昇腾 950 超节点,昇腾 950PR 已于 4 月启动量产、950DT 高带宽版据报道由四季度提前至 8 月上云;此前 Atlas 900 A3 单集群 300 PFLOPs(约为 GB200 NVL72 的 1.7 倍)的对标数据维持。寒武纪思元 690(双 Die、FP16 逾 700 TFLOPS、196GB HBM3)已于年初量产并在发布当日适配 DeepSeek-V4,公司 7 月 1 日市值首破万亿元;摩尔线程、沐曦(2025 年 12 月上市)已双双调入科创 50。7 月 19 日,商汤联合寒武纪、摩尔线程、壁仞等近 20 家企业发布「国产 AI 基础设施生态共建计划」(据媒体报道)。
二、出口管制博弈:从 H20 到 H200
时间线已完整:1 月 13 日美方批准 H200 对华出口,附加销售额 25% 上缴美国政府、全额预付且不可退等条件;中国商务部 24 小时内宣布暂停 H200 采购并取消超亿元订单;H20 已于年初停产。此后半年美方多次确认「零交付/微量交付」:4 月美商务部长承认「一颗都没卖出去」;7 月 14 日商务部官员 Kessler 国会作证称,对华(含香港)实际交付「微不足道」,尽管已批准约 100 亿美元许可。据报道,中企 2026 年累计下单超 200 万颗,而英伟达库存约 70 万颗;英伟达全年指引已将对华 H200 收入按零计,Blackwell 系列仍禁止对华直售。我们维持原判断:博弈已从「美方卡脖子」转入「中方选择权」阶段——放行与否不再是关键变量,中方以国产替代为优先,H200 更多成为谈判筹码而非必需品。该判断为分析性观点,存在政策反复风险。
H200 放行却滞销:英伟达把中国收入记为零(数据更新至 2026-09-03)
8月把报告的核心判断从行业推断变成了财务报表上的数字:整体是验证,外加一处修正。
已证实(彭博社、CNBC,8月26日):英伟达二季报显示,H200对华销售不足当季约890亿美元数据中心营收的1%;过去六个月为过剩H200库存计提4亿美元减值;下季指引干脆把中国数据中心收入按零计算。华盛顿放了行,买家拿到了许可,芯片还是卖不动。「能买到也不买」如今有了英伟达自己盖章的版本。
据报道(英国《金融时报》,8月18日;单一信源,上述数字未获交叉验证):字节跳动与腾讯各接收约1万颗H200,是去年12月美方放行以来首批实际入境的批量交付;监管同时要求其余获批芯片留在香港等境外使用。
修正在「不买」二字。北京并非一刀切禁买,而是计量式放行:给谁、给多少、在哪里用,全由监管说了算。外国算力从商品变成配给品,这比抵制更能说明自主已是既定路线。
天际立场 · 开源破局:算力墙被成本曲线绕开(2026-09-03 厦门演讲)
这份演讲给本报告的结论补上了机制,份额数字则用了一个更保守的口径。
先说份额。本报告用 2026 年一季度的 52.3% 说国产份额过半;张倩在厦门引用的国产 AI 加速卡份额是 41%。两个数字口径不同,本文不硬拼。演讲多说的一句更要紧:主流开源模型已完成向国产算力迁移。「能买到也不买」要成立,先得有得换。迁移完成,前提就坐实了。
再说机制。演讲把算力约束的出路放在成本曲线上,依据是硬件侧的一笔账:2012 到 2023 年计算效率提升约 1000 倍,其中量化贡献 32 倍,指令集 12.5 倍,制程从 22nm 到 4nm 只有 3 倍。这组拆解是天际的口径。天际由此判断,下一个 1000 倍要从架构里拿,制程给不了。三个方向是硅光互联、存算一体、3D 集成,天际在每个方向各有一家被投公司。一个旁证:人脑 20 瓦,机器人装不下 1000 瓦的 GPU。我们的读数是,瓶颈正从算力迁到带宽与能效。
芯片层的定价,演讲的判断是二级已定调。摩尔线程、沐曦 2025 年 12 月上市以来盘中峰值涨幅 +724%、+887%,寒武纪 2026 年初至今 +22%(Wind,截至 2026 年上半年)。超额收益仍在一级,但 Pre-IPO 已过热,50 到 100 倍市销率成了常态,天际对这一段保持审慎。
完整图版:/reports/open-source-breakthrough(前 5 页公开)。
9 月上旬更新 · 已核实(数据更新至 2026-09-09):华盛顿明确本月峰会不谈放松芯片管制,DeepSeek 计划部署 16 万颗昇腾 950DT,国产算力从「替代选项」转为「默认采购」,瓶颈移到供给侧
已证实(CNBC 采访 2026 年 9 月 2 日,经 Asia Today 9 月 4 日转述):美国商务部长卢特尼克 9 月 2 日在 G20 创新部长会议期间接受 CNBC 采访,被问及本月晚些时候特朗普与习近平会晤是否讨论放松芯片出口管制,回答「不,我不这么认为」,并称特朗普递出了橄榄枝,中方没有接。据 Export Compliance Daily 9 月 4 日报道,他同时表示美方将加快把 AI 芯片许可转向盟友。Asia Today 同文提到,H200 于 1 月获准对华出口后,中方先以安全为由限制进口,7 月起据报道放行小批量,因此「零成交」不宜作为定论。
据报道(彭博社,2026 年 9 月 4 日;TechNode 9 月 7 日跟进):DeepSeek 计划在内蒙古一座吉瓦级数据中心部署至少 16 万颗华为昇腾 950DT,只用于推理,目前没有用于训练的计划。彭博社援引知情人称,交付取决于华为产能,高端存储短缺会拉长周期,部分产能目标 2027 年底或 2028 年初投运。若落地,将是已知最大的华为 AI 芯片集群。TechNode 强调这仍是计划,并非已完成的部署。
已证实(PyTorch 基金会新闻稿,上海,2026 年 9 月 7 日):在 9 月 7 日至 9 日于上海举行的 KubeCon + CloudNativeCon + OpenInfra Summit + PyTorch Conference China 2026 上,阿里云与寒武纪以白金会员、蚂蚁集团以金牌会员身份加入 PyTorch 基金会,白金会员享有董事会席位;华为 2023 年已加入基金会,并参与创建加速器集成工作组。基金会称中国已有超过 250 家机构向其项目贡献代码。国产芯片厂商由此进入上游框架的治理层。
对本报告结论的影响:加固了「能买到也不买」的核心判断,但口径要收紧。卢特尼克确认放松管制不在议程、中方未接受芯片销售提议,与第二章「H200 放行却滞销」方向一致;H200 是否完全零成交存在分歧报道,报告应写「销量极低」而非「零」。DeepSeek 的 16 万卡计划把「国产芯片跑国产模型」从政府主导的韶关集群推进到头部模型公司的商业采购,虽然用途是推理而非训练。需要修正的是供给侧:交付受华为产能与高端存储制约,瓶颈已从「愿不愿意用」转到「供不供得上」,报告对 2026 年下半年国产算力供给的乐观程度应下调。寒武纪进入 PyTorch 董事会,说明软件适配这一短板在缩小。
9 月中下旬更新 · 已核实(数据更新至 2026-09-25):昇腾 960 提前三个季度,国产算力的硬约束从芯片转到 HBM
据报道(路透社,2026 年 9 月 10 日):路透社援引三位知情人士报道,过去两个月华为把昇腾系列 AI 芯片报价上调 20%–50%,寒武纪上调 20%–30%,沐曦、天数智芯也有相近幅度的涨价。昇腾 950DT 报价升至 25 万元以上,950PR 从年初约 6 万元涨到 8 万元以上,910C 从约 9 万元涨到 11 万元以上;寒武纪下一代芯片(暂名 690)较两个月前的指导价上调 20%–30%。原因是 HBM 短缺:2024 年 12 月美方收紧先进 HBM 对华出口后,国内厂商转向灰色渠道,采购价通常是境外买家的数倍。950DT 预计 2026 年四季度供货。
已证实(华为全联接大会 2026,2026 年 9 月 17 日;21 财经、腾讯新闻 9 月 18 日转述):华为轮值董事长汪涛发布采用 NPO 光互联的昇腾 960 超节点。960DT 训练卡 FP8 算力 2 PFLOPS、配 288GB HBM、带宽 9.6TB/s,2027 年一季度就绪,较原计划提前三个季度;960PR 推理卡 FP4 算力 8 PFLOPS,2027 年三季度落地,提前一个季度;两者性能均较上代翻倍。单个 NPO 超节点最多互联 4096 张昇腾卡,FP8 算力最高 8 EFLOPS、HBM 总容量最高 1PB。华为同时披露昇腾超节点累计部署超过 1000 套,950 超节点已规模商用;970、980 分别定于 2028 年、2029 年,此后一年一代。
已证实(中国电信、IT 之家,2026 年 9 月 19 日):中国电信 9 月 17 日发布、9 月 19 日开源星辰 Xing4.0-29B-A4B:总参数 29B、激活 4B,原生 256K 上下文,基于昇腾算力与国产框架完成训练。公司称其为国内首个基于国产算力与国产框架完成训练的百亿参数大模型。SuperCLUE 智能体能力评测得分 93.52 列第 3,与前两名 Qwen 模型差距不到 1 分;4-bit 量化后显存占用降至 15GB,较 FP16 省约 75%。
对本报告结论的影响:加固了「能买到也不买」的核心判断。昇腾 960 提前三个季度、超节点部署过千套,国产算力的供给曲线在加速;Xing4.0 是「国芯训国模」从示范集群走到运营商量产模型的一个样本。修正一条:报告把约束放在先进制程与 H200 博弈上,9 月 10 日的集体涨价说明 2026 年下半年的硬约束是 HBM。灰色渠道 HBM 采购价数倍于境外,正在侵蚀国产算力的总拥有成本优势,下一版应把 HBM 国产化进度列为独立跟踪指标。
9 月末至 10 月初更新 · 已核实(数据更新至 2026-10-02):DeepSeek 开源与英伟达版一一对应的昇腾全套基础组件,北京据报道考虑允许字节、阿里采购英伟达 RTX Pro 5500
已证实(DeepSeek 公告,财联社、网易报道,2026 年 9 月 30 日):DeepSeek 宣布开源面向华为昇腾平台的全套基础设施组件,包括 TileLang 编程语言昇腾版、计算库与分布式通信库,具体有 DeepGEMM(矩阵运算)、DeepEP(通信)、FlashMLA(稀疏注意力)、TileKernels 与 DeepSelect,与其此前面向英伟达平台开源的组件一一对应;财联社称相关成果已在华为 CANN 社区同步开源。网易报道,FlashMLA 项目文档给出了在昇腾 950 上的测试结果。
据报道(The Information,2026 年 9 月 27 日,路透社、The Next Web 转述):工信部近期要求包括字节跳动、阿里巴巴在内的企业上报计划采购英伟达 RTX Pro 5500 的数量与用途,并向部分企业表示政府有意批准。该卡是英伟达 9 月发布的 Blackwell 架构工作站显卡,配 84GB 显存;报道称部分业内人士预计它可避开美方出口限制。路透社表示未能独立核实,截至报道时英伟达、阿里、字节与工信部均未公开置评。
对本报告判断的影响:第一件事强化核心判断。软件迁移成本一直是国产芯片推广的主要障碍之一,DeepSeek 把与英伟达版对应的计算与通信基础组件开源到昇腾上,降低了其他公司从 CUDA 切换的门槛,与 9 月上旬记录的「部署 16 万颗昇腾 950DT」计划方向一致。第二件事是待确认的修正信号:若报道属实,北京开始对英伟达产品按品类区别对待,H200 等数据中心卡此前被暂停采购,工作站级产品则可能获批。若工信部正式批准,本报告「能买到也不买」的表述需收窄为针对数据中心训练卡。观察阈值:若正式批准且单家采购量达到数万张以上,需评估其对国产推理卡份额的挤出。
关键问答
2026年国产AI芯片市场份额是多少?超过一半了吗?
已首次过半:2026年一季度国产AI芯片在中国市场份额达52.3%,其中华为昇腾约占37%居首。7月9日大湾区首个全国产昇腾万卡集群在韶关上线(11520卡、总算力9000P、投资约55亿元),WAIC 2026上昇腾950超节点真机首秀。
美国放行H200后,中国到底买了没有?实际交付了多少?
基本没买。美方1月13日附条件放行(销售额25%上缴、全额预付不可退),中国商务部24小时内暂停采购并取消订单。7月14日美商务部官员国会作证称实际交付「微不足道」,虽已批约100亿美元许可;英伟达指引已按对华H200收入为零计算。
Kimi K3是全球最大的开源模型吗?月之暗面最新估值多少?
是。7月16日发布的Kimi K3达2.8万亿参数,为史上最大开源模型,支持1M上下文,在Arena.ai前端编程竞技场以1679分登顶,7月27日全量权重上线Hugging Face。月之暗面7月29日完成超35亿美元F轮,投后估值350亿美元。
延伸观看 · 收听
▶ 算力投资的钱到底该往哪放YouTube · 海外(国内需 VPN)
▶ 全景解读智算赛道 | 创业邦采访YouTube · 海外(国内需 VPN)🇨🇳 国内观看:微信搜视频号「倩姐投AI」或公众号「天际科技投资」;完整视频与播客 → 倩姐投AI 视频与播客
信源与标准
本报告基于公开信息整理,数据更新至 2026.06.24。行文中区分「已证实 / 据报道 / 我们的估算 / 存疑」四档,估算均写明推算方法。若我们出错,更正会写进报告正文并保留原判断,同时登记在公开更正记录中。
研究标准与更正记录 →📄 完整报告
完整报告共 14 页 · 仅向合格投资人与合作伙伴定向提供
以上是公开预览。完整版含以下章节,依合规要求不在公开页提供,也不提供免费下载。如需全文,请联系天际同事索取。
- 🔒三、模型层拉动:开源旗舰与国产算力互认
- 🔒四、全球对照:电力成为第一瓶颈
- 🔒五、资本市场:叙事溢价与兑现压力
- 🔒六、生态外溢:硬件之争、诉讼与出海样本
- 🔒七、价值链观察(中性框架)
- 🔒风险提示与数据来源
我们对这件事的判断
开源破局:成本曲线的制定者换了
这一轮 AI 的分水岭是成本曲线,压下它的是开源。闭源的护城河是资本开支,靠再融资维持;开源的护城河是活着的社区,不需再融资。制定曲线的人从美国闭源换成了中国开源,价值移向应用层与开源关口。
完整论证与证伪条件 →中美 AI:同一周期的两个位置
中美处在同一个 AI 周期的两个位置:美国在狂热期后段,中国在前中段。钱的差距约 14 倍,模型能力差距约 2.7%,估值折价约三分之一。折价正被收入以美元计价的创业者自己抹平。
完整论证与证伪条件 →常被问到
相关报告
本报告为天际资本 AI 研究院出品的产业研究,基于公开信息整理,不构成投资建议;不含基金业绩、AUM 或募资要约。