Skip to content
AI 基础设施周报2026 · 06 · 26

中国 2 万亿元国产算力栈、高通 100 亿抢购 Tenstorrent、GLM-5.2/Kimi 开源追至前沿

中国 2 万亿元国产算力计划、高通洽购 Tenstorrent、GLM-5.2 与 Kimi K2.7 Code 开源追赶同时出现,AI 基础设施正从芯片、云到模型层面加速分叉。

近两周,AI 基础设施层的重心从模型发布转向了底层供给的重新划界。中国把一份约 2950 亿美元、要求 80% 国产芯片的国家级数据中心计划摆上台面,等于在最大的一块新增算力采购里把英伟达和 AMD 写出局;同一周高通出价 80–100 亿美元谈判收购 Tenstorrent,想在英伟达和 AMD 之外再立一根芯片支柱。模型层并没有停——Z.ai 的 GLM-5.2 和月之暗面的 Kimi K2.7 Code 把开源权重在编程基准上推到与 GPT-5.5、Opus 4.8 同台的位置,而 Gemini 3.5 Pro 的 GA 一再延后、GPT-5.6 蓄势待发,前沿发布挤在六月最后十天。中美双栈在硬件层被政策劈开,模型层每两周换一次性价比冠军,底层内存和整机价格还在往上抬。芯片、云、模型三层在同一段时间各自分叉,企业这两周要应对的供应栈复杂度,高于以往任何一次只发生在单一层面的变动。

中国 2950 亿美元国产算力栈:80% 国产芯片门槛把英伟达写出最大增量采购

6 月下旬,多家媒体援引彭博报道,中国国家发改委等部委正在起草一份未来五年投入约 2 万亿元人民币(约 2950 亿美元)的国家级 AI 数据中心计划,核心条款是新建算力的芯片至少 80% 来自本土供应商。这份草案尚未正式发布、目标与时间表仍可能调整,但方向已经清晰:在全球最大的一块新增算力采购里,英伟达和 AMD 被结构性地排除在外,受益方指向华为、寒武纪、壁仞科技、摩尔线程、阿里平头哥等本土厂商,其中多家在 5 月已拿到扩大的政府采购许可。这接续了北京自 2025 年 8 月起对数据中心提出的 50% 本土采购要求,把比例进一步抬到 80%。对照英伟达自身披露的数字——截至 2026 年 4 月的财季,其面向中国的数据中心 Hopper 产品出货为零,而上年同期为 46 亿美元——可以看到,即便美方今年把 H200 等芯片的对华许可从推定拒绝放宽到逐案审查,中国侧的国产替代政策也在反向收口,让对华大额芯片销售在结构上难以恢复。对跨境部署的企业来说,这意味着中美算力栈在硬件层正被政策劈成两套,同一套 AI 应用在两侧跑,底层芯片、可用模型、合规边界都不一样。供应链规划要按双栈来做:硬件、模型与合规在两边各成一套,迁移路径、灾备假设、采购合同的前提都得分别重写,越早把两侧的供给差异盘清楚,越不容易在任何一侧的政策摆动中被动停摆。

高通 80–100 亿美元谈判收购 Tenstorrent:英伟达、AMD 之外的第三根芯片支柱

6 月 16 日,路透等媒体报道,高通正就收购 AI 芯片公司 Tenstorrent 展开谈判,交易估值在 80 至 100 亿美元之间,远高于 Tenstorrent 此前估值,最终价格可能因业绩对赌进一步抬高,双方均不予置评、交易未必达成。Tenstorrent 由传奇芯片设计师 Jim Keller(曾主导苹果芯片与特斯拉自动驾驶芯片)领衔,走 RISC-V 开放指令集路线,其 AI 处理器主打在特定负载上比传统 GPU 更高效。对企业决策者,这桩交易的意义不在于多一个芯片品牌,而在于数据中心推理芯片的供给开始出现英伟达、AMD 之外的第三极——高通带着移动端的能效积累和资本实力入场,叠加微软 Maia、谷歌 TPU、亚马逊 Trainium 等自研芯片,推理底层正在从单一 GPU 货架走向多元加速器并存。问题随之而来:当底层芯片厂商越来越多、各家软件栈互不兼容,企业的模型部署会不会被绑死在某一家加速器的生态里。保持在抽象层做调度、让上层应用对底层是哪一种加速器无感,是企业在这一轮芯片多元化里保住选择权的前提。

中国开源权重追至前沿:GLM-5.2 与 Kimi K2.7 Code 同台闭源旗舰

模型层的追赶在这两周集中体现在中国开源权重上。Z.ai 于 6 月 16 日发布新旗舰 GLM-5.2,744B 参数、约 40B 激活,1M token 上下文,官方基准里 SWE-bench Pro 报 62.1%、Terminal-Bench 2.1 报 81.0,宣称在标准化编程任务上领先 GPT-5.5 与 Kimi K2.7-Code。月之暗面则在 6 月 12 日推出编程特化的 Kimi K2.7 Code,约 1T 参数、32B 激活的 MoE 架构,相比 K2.6 把思考 token 削减约 30%,在自家 Kimi Code Bench v2 上报 62.0,对照 GPT-5.5 的 69.0 与 Claude Opus 4.8 的 67.4。两者都是 open weight,可私有部署。社区评测对官方基准持审慎态度——厂商自报基准的口径差异较大,第三方独立复现仍在进行,企业不宜直接照搬厂商榜单做选型。但方向是确定的:开源权重在编程这一最具商业价值的场景上,已经把与闭源旗舰的差距压到可以用价格和可控性来弥补的程度。对成本敏感的企业,这意味着同一个编程或 agent 工作流,完全可以按任务难度在高价闭源旗舰与低价开源权重之间分流——把复杂推理留给前沿模型、把批量任务交给开源权重,整体推理账单能差出一个量级。AgentsFlare 的按任务类型路由与精准配额管理正是把这种分流落到每个团队、每个项目的预算上,避免高价模型把成本拖到失控;而当某类调用沉淀出规模后,企业实际拿到的计费档位往往比账面价目表更松。

六月末前沿发布窗口收紧,IPO 前的定价博弈悬在头上

六月最后十天挤进了年内最密集的前沿发布。谷歌在 5 月 19 日 I/O 上预告的 Gemini 3.5 Pro(2M token 上下文、Deep Think 推理模式)截至 6 月 23 日仍停留在 Vertex AI 的有限预览、未正式 GA,官方定价未公布,市场对 6 月底前发布的概率只给到五成上下。OpenAI 代号「Kindle」的 GPT-5.6 主打推理、自动化与 token 效率,预测市场一度把 6 月底前发布的概率押到接近九成,但官方尚未正式宣布。Anthropic 则在 6 月 9 日上线、被视为首个 Mythos 级架构公开模型的 Claude Fable 5($10/$50 每百万 token)之后,继续向全量客户铺开 Mythos 1 能力。这一波密集发布的背景,是 OpenAI 与 Anthropic 双双走向 IPO 时的定价博弈:两家都在权衡大幅下调 token 价格以在上市前守住企业份额,定价进入公开市场审视期。对企业,这是一段价目表每两周变一次的窗口期——新模型上线、旧模型降价或退场、性价比冠军频繁易主。把成本归因做到 endpoint、用户、团队、模型四个维度,企业才能在每一次价目表变动后快速判断该把哪类流量切到哪个模型,而不是等季度账单出来才发现预算被某个高价模型悄悄吃掉。

算力上游信号:涨价从 HBM 蔓延到整台服务器

本期上游延续模型层之外的供给观察,两条信号直接传导到企业的推理成本与可得性。

内存合约价的上行没有停。TrendForce 在 6 月下旬的数据显示,DRAM 各品类二季度已显著上涨、三季度趋势延续,部分品类(如 DDR2)三季度环比再涨 35–40%;HBM3e 与服务器 DDR5 的价差则在收窄,DDR5 盈利能力预计自明年一季度起反超 HBM3e。这层价差收窄的含义是,涨价已经从 GPU 旁的高端 HBM(高带宽内存,AI 加速卡上紧贴 GPU 的高速内存,是当前最紧的瓶颈环节)蔓延到通用服务器内存:原厂把产能挤向 HBM,普通 DDR5 随之变紧、价格和利润一起被抬高,成本压力从最高端的 AI 加速卡扩散到整台服务器的物料,企业的算力账单不再只是加速卡这一项在涨。传导路径很直接:内存是 AI 服务器整机成本的大头,内存涨价会沿着整机报价压到云厂商的 CapEx,最终体现在推理实例的单价上。

整机价格的台阶也在抬高。据摩根士丹利测算,英伟达下一代 Vera Rubin 架构的 VR200 NVL72 整机对超大规模云厂商的报价约为 780 万美元一台,较上一代 GB300 的约 400 万美元接近翻倍,单颗 Rubin GPU 的大批量采购价约 5.5 万美元。整机单价翻倍意味着同等算力的折旧成本上升,云厂商要么压缩利润、要么把成本转嫁到推理定价——这也部分解释了为什么前沿厂商一边喊降价抢份额、一边底层成本却在往上走,两股力量最终会在企业的推理账单上交汇。对企业,与其去赌某一代硬件的价格拐点,不如把成本治理做在调用层:用精细配额和成本归因守住预算上限,让底层硬件和内存的涨跌不至于直接击穿某个团队的额度。

本周判断

AI 供应栈正在沿三条接缝同时分叉。硬件层被政策劈成中美双栈,中国用 80% 国产门槛把增量采购国产化,美方的逐案审查也挡不住这道反向收口;芯片层在英伟达、AMD 之外长出高通、各家云自研等多极,加速器生态开始碎片化;模型层则在开源追赶与 IPO 前价格战的双重作用下,性价比冠军每两周易主一次。三层分叉之下,企业靠「选定一家、长期绑定」获得的确定性正在消失——任何单点押注,都会在某一层的政策摆动、并购重组或价格突袭中变成被动。把上层业务对底层是哪国芯片、哪种加速器、哪家模型做到尽量无感、把切换成本压到最低,是企业在这一周比以往更需要一层独立 Gateway / 控制面的现实理由。

底层在分叉,上层要稳得住,靠的是把模型、芯片、云的变动都收进同一层可调度、可计量、可审计的控制面。谁先把这层建起来,谁就能在每一次重新划界里继续保留选择权。

参考资料

China AI Data Center Grid Locks Out Nvidia With $295 Billion Domestic Chip Mandate — Tech Times — 2026-06-22 — https://www.techtimes.com/articles/318868/20260622/china-ai-data-center-grid-locks-out-nvidia-295-billion-domestic-chip-mandate.htm

China Drafts $295 Billion Plan for Domestic AI Data Centers, Mandating 80% Local Chips — MLQ News — 2026-06 — https://mlq.ai/news/china-drafts-295-billion-plan-for-domestic-ai-data-centers-mandating-80-local-chips/

China drafts $295 billion plan to build a national AI data center grid running on 80% domestic chips — Tom's Hardware — 2026-06 — https://www.tomshardware.com/tech-industry/china-drafts-295-billion-plan-to-build-a-national-ai-data-center-grid-running-on-80-percent-domestic-chips

US says ban on AI chip shipments applies to Chinese firms outside China — Al Jazeera — 2026-06-01 — https://www.aljazeera.com/economy/2026/6/1/us-says-ban-on-ai-chip-shipments-applies-to-chinese-firms-outside-china

Qualcomm in Talks to Acquire AI Chip Startup Tenstorrent for Up to $10 Billion, Reuters Reports — Yahoo Finance — 2026-06-16 — https://finance.yahoo.com/technology/ai/articles/qualcomm-talks-acquire-ai-chip-230401789.html

Qualcomm said to be circling AI chip biz Tenstorrent in $10B RISC-V power play — The Register — 2026-06-16 — https://www.theregister.com/systems/2026/06/16/qualcomm-said-to-be-circling-ai-chip-biz-tenstorrent-in-10b-risc-v-power-play/

GLM-5.2: Features, Setup, Benchmarks, and Model Switching Guide — DataCamp — 2026-06 — https://www.datacamp.com/blog/glm-5-2

GLM-5.2 vs Kimi K2.7 Code: Early Coding Tests Compared — Implicator.ai — 2026-06 — https://www.implicator.ai/glm-5-2-edges-kimi-k2-7-code-in-early-coding-tests/

Kimi K2.7 Code Review: Open-Source 1T Parameter Model Cuts Reasoning Tokens 30% — Flowtivity — 2026-06 — https://flowtivity.ai/blog/kimi-k2-7-code-review/

AI Rumors June 2026: GPT-5.6, Gemini 3.5 Pro, Claude Mythos — centerbit — 2026-06 — https://centerbit.co/en/blog/ai-rumors-june-2026-gpt-5-6-gemini-3-5-pro-claude-mythos

Gemini 3.5 Pro: What We Actually Know Before GA — FrankX.AI — 2026-06-23 — https://www.frankx.ai/blog/gemini-3-5-pro-analysis-2026

OpenAI Weighs Drastic Token Price Cuts to Counter Anthropic Ahead of Dueling IPOs — MLQ News — 2026-06-11 — https://mlq.ai/news/openai-weighs-drastic-token-price-cuts-to-counter-anthropic-ahead-of-dueling-ipos/

Consumer DRAM Shortages Extend to DDR2 Products with Contract Prices Expected to Continue Rising in 3Q26 — TrendForce — 2026-06-22 — https://www.trendforce.com/presscenter/news/20260622-13112.html

The State Of AI Infrastructure: Demand, Costs, And Custom Silicon(VR200 NVL72 整机报价,摩根士丹利) — ARK Invest / Morgan Stanley Research — 2026-06 — https://www.ark-invest.com/articles/analyst-research/the-state-of-ai-infrastructure-demand-costs-custom-silicon

NVIDIA China Data Center Hopper shipments(对华出货为零 vs 上年 $4.6B) — CNBC — 2026-02-26 — https://www.cnbc.com/2026/02/26/nvidia-china-chip-sales-export-controls-ai-competition.html