AI 基础设施周报

英伟达 500 亿美元租下德州数据中心、超大规模厂商把 2026 资本开支抬到 7250 亿美元、Qwen 多模态报到 0.03/0.13 美元

Author

AgentsFlare Research

Date Published

本周定价动作密集:OpenAI 7 月 30 日把 GPT-5.6 最便宜的 Luna 档降价约 80%、中档 Terra 降约 20%,阿里 7 月 27 日的 Qwen 3.7 Flash 把带 100 万上下文的多模态模型压到每百万 token 0.03/0.13 美元,中美两头同时把价格往成本敏感的一端打;而更密集的动作在算力物理层。7 月 28 日,英伟达签下最高 500 亿美元的德州数据中心长租,一家造芯片的公司开始亲自当算力房东;同一周超大规模四家把 2026 年资本开支合计抬到约 7250 亿美元、同比涨 77%,而这一次资本市场第一次集体用脚投票,谷歌、亚马逊、微软、Meta 财报后股价齐跌。产业阵营侧,英伟达 7 月 27 日拉起 37 家成员的开放安全联盟,OpenAI、Anthropic、谷歌、Meta 四家前沿模型厂全部缺席;欧盟 7 月 30 日启动 300 亿欧元的算力工厂招标,把算力主权写进了招标文件。芯片厂、云厂、政府三方在同一周里各自出手抢占物理层,模型层的热闹反而退居其次。

执行摘要

本篇核心判断:

  • 英伟达与数据中心开发商 Hut 8 签署德州 Beacon Point 数据中心长租,基础 15 年约 196 亿美元、含续约选项最高 502 亿美元,支持最高 1GW 电力,芯片厂首次以租户身份直接锁定物理算力(7/28)
  • AMD 承诺向 Anthropic 战略投资最高 50 亿美元、Anthropic 将部署最高 2GW 的 MI450 系列 GPU(首期 1GW 于 2027 上半年上线);英伟达之外的第二芯片极同周成形(7/22,AMD Helios 机柜 7/23 发布)
  • 超大规模四家 2026 资本开支指引合计约 7250 亿美元、同比涨 77%:微软约 1900 亿、亚马逊约 2200 亿、谷歌 1800–1900 亿、Meta 1300–1450 亿;谷歌财报后股价跌约 7%,亚马逊、微软、Meta 同期普跌(Q2 财报季 7 月下旬)
  • OpenAI 下调 GPT-5.6 两个低价档:Luna 从 1/6 美元降到 0.20/1.20 美元(降约 80%)、Terra 从 2.50/15 美元降到 2/12 美元(降约 20%),旗舰 Sol 维持 5/30 美元不变,官方点名面向成本敏感客户(7/30)
  • 阿里 Qwen 3.7 Flash 发布,每百万 token 报价 0.03/0.13 美元、100 万上下文、支持视觉,是目前最便宜的百万上下文多模态模型(7/27)
  • 英伟达联合微软、Palantir、IBM、Dell、CrowdStrike 等 37 家成立开放安全 AI 联盟,OpenAI、Anthropic、谷歌、Meta 四家前沿模型厂缺席(7/27)
  • 欧盟委员会启动 7 座 AI 算力工厂招标:10 亿欧元公共资金撬动 20 亿欧元私人投资、合计约 300 亿欧元,投标截止 11/12,意在削减对美亚算力的依赖(7/30)
  • 算力上游:TrendForce 预测三季度服务器 DRAM 合约价环比涨 13–18%、涨价压力转向没有长约的客户,HBM 合约价 2027 年预期成倍上涨;同期 H100、B200 按需租金处于历史低位(7 月)

AgentsFlare 是企业的 AI 控制平面——在模型、云与智能体不断分裂的环境里,替企业守住调用路由、成本归因与访问审计这条主动权。AI Infra Weekly 是 AgentsFlare 为企业用户推出的战略专栏,从独立视角追踪全球 AI 基础设施层的关键变动,帮企业在格局固化之前先一步看清方向。

主要事件

英伟达 500 亿美元租下德州数据中心:造芯片的开始自己当房东

7 月 28 日,英伟达被证实是数据中心开发商 Hut 8 位于德州 Beacon Point 数据中心的承租方,租约基础期 15 年、价值约 196 亿美元,若续约选项全部行使,总额最高可达 502 亿美元,可支持最高 1GW 电力。对一家历史上只卖芯片、把建数据中心留给客户的公司,直接以租户身份把物理算力锁进 15 年合同,是位置的实质性变化:过去英伟达在供应链里的角色是上游元器件供应商,现在它同时是资本层面的算力承租方与运营复杂度、监管暴露的承担方。市场普遍把这笔租约和另有报道称英伟达正在为 OpenAI 的大型数据中心提供最高 2500 亿美元财务担保的传闻放在一起读,后者尚未获官方确认,但两条合起来指向同一个动作:英伟达在用自己的资产负债表替下游客户的算力扩张兜底。

这不是本周唯一一笔把芯片厂推向物理层的交易。7 月 22 日,AMD 宣布向 Anthropic 战略投资最高 50 亿美元,Anthropic 将部署最高 2GW 的 AMD Instinct MI450 系列 GPU,首期 1GW 于 2027 年上半年上线,硬件形态是 AMD 7 月 23 日刚发布的 Helios 整机柜(把 GPU、CPU、网络、存储按机柜整体交付的一体化系统,单柜约 2.9 exaflops 推理算力、报价 500–550 万美元);微软与 OpenAI 同周表态将大规模部署 Helios。两笔交易叠加,英伟达之外的第二芯片极在同一周成形,而两极的共同点是芯片厂都不再只卖硬件,而是用股权投资和自建租赁把自己嵌进客户的算力堆栈。对企业,这层变化的含义是供应链集中度在从模型层向下渗透到硬件与资本层:当造芯片的、供模型的、建数据中心的三重身份开始由同一批公司交叉持有,vendor lock-in 的风险不再只体现在 API 账单上,而是沉到了物理算力的所有权结构里。企业在硬件双栈(英伟达与 AMD 各自的机柜、网络、软件生态互不兼容)之间保留调度与迁移能力,价值比一年前更实。

超大规模厂商把 2026 资本开支抬到 7250 亿美元,市场第一次集体用脚投票

7 月下旬的 Q2 财报季里,超大规模四家把 2026 年的资本开支指引再次上修,合计约 7250 亿美元,较 2025 年的 4100 亿美元同比涨约 77%:微软全年资本开支定在约 1900 亿美元、远高于分析师约 1520 亿的预期,亚马逊上修到约 2200 亿,谷歌维持 1800–1900 亿,Meta 把区间上沿抬到 1450 亿。需求侧的数字仍然亮眼,谷歌云单季收入同比涨约 63% 到 200 亿美元上下,增速远快于市场此前预期。

真正的转折在市场反应。谷歌财报公布后股价单日跌约 7%,随后几天亚马逊、微软、Meta 也跟着下挫——资本市场第一次对这轮资本开支竞赛集体表达了怀疑,投资者担心的是现金储备被持续消耗,而回报的确定性还没跟上。这个信号对企业客户的意义不在股价本身,而在它可能改变超大规模厂商未来的定价与配额行为:如果资本市场持续施压要求资本开支产出回报,云厂商把高昂基建成本转嫁到推理定价、专用产能优先分配给自有模型和大客户的动机都会加强。企业把 AI 负载绑定在单一超大规模云上时,正在同时押注这家厂商的资本纪律和它未来的转嫁能力,这两项现在都进入了不确定区间。

OpenAI 把 GPT-5.6 低价档降 80%、Qwen 多模态报到 0.03/0.13 美元:定价战往成本敏感的一端打

本周模型层最密集的动作发生在定价侧,中美两头同时把价格往下压。7 月 30 日,OpenAI 下调 GPT-5.6 两个低价档:最便宜的 Luna 从每百万 token 1/6 美元降到 0.20/1.20 美元、降幅约 80%,中档 Terra 从 2.50/15 美元降到 2/12 美元、降幅约 20%,旗舰 Sol 维持 5/30 美元不变,并配套给缓存读取 90% 折扣。OpenAI 把降价归因于软件栈的整体优化——更好的硬件路由、更快的推理软件、更聪明的上下文缓存算法,让智能体不必重复已经算过的工作。发布时点也说明问题:距 GPT-5.6 三家公开发布仅约三周就降价,官方口径直接点出面对的是一批对成本越来越敏感、在看不清回报前不愿部署昂贵模型的企业客户——这和本周超大规模厂商在资本市场遭遇的回报质疑是同一股压力的两个断面。

同一周的另一头,7 月 27 日阿里发布 Qwen 3.7 Flash,每百万 token 输入 0.03 美元、输出 0.13 美元,带 100 万 token 上下文,支持视觉输入、工具调用与函数调用,是目前市面上最便宜的百万上下文多模态模型,在阿里自家产品线里位于 Qwen 3.7 Plus(0.28/0.86 美元)和 Qwen 3.7 Max(2.50/7.50 美元)之下。这里要留一个保留:阿里没有发布这一变体的技术报告、基准测试套件或架构说明,独立第三方评测数据暂缺,实际能力要等社区跑分验证,报价的激进不等于能力的对标。而价格光谱的另一端仍然坚挺,三天前的 7 月 24 日 Anthropic 发布 Claude Opus 5,报价 5/25 美元、约为 Fable 5 的一半,前沿闭源旗舰按能力定价、单价仍在两位数区间。

三条放在一起,2026 年这条价差在持续走阔的同时,走阔的动力从单纯的中国厂商压价,扩展到美系前沿厂主动把低价档打下去抢成本敏感的量。对企业的直接含义是同一个工作流里不同环节的最优模型来自完全不同的价格带:批量的多模态预处理、分类、抽取用分币级到角币级的模型就能覆盖,只有真正吃能力的推理环节才值得调用两位数单价的旗舰。按任务类型和成本预算把请求分流到不同模型、并对每个团队和项目的 token 消耗设配额,是把这条走阔的价差转化为实际成本节约的前提;而当同一家厂商的不同档位、不同厂商的同类模型都在频繁调价,能按最新价目表动态路由、并把成本按模型与供应商维度归因,比锁定单一模型更能吃到降价红利。

英伟达拉 37 家组开放安全联盟,四大前沿模型厂全体缺席

7 月 27 日,英伟达联合 37 家成员发起开放安全 AI 联盟(Open Secure AI Alliance),共建并共享 AI 网络安全与智能体安全的开源工具,成员包括微软、Palantir、IBM、Dell、CrowdStrike、Snowflake、Databricks、Cisco、Palo Alto Networks、Red Hat、Hugging Face、Linux 基金会等。发起背景之一是此前 OpenAI 遭遇的一次网络攻击。最值得注意的是缺席名单:OpenAI、Anthropic、谷歌、Meta 这四家前沿模型厂全部不在创始成员之列。

这个组合把一条产业裂缝摆到了台面上。联盟聚拢的是掌握芯片、服务器、数据栈与安全能力的基础设施阵营,缺席的是掌握闭源模型 API 的模型厂。Palantir 一方在场合中点出的判断颇具代表性:企业一边为 token 付费,一边眼看着自己的专有洞察随着调用流向模型实验室,这种交换正在引起反弹。对企业决策者,这条裂缝把一个一直存在但容易被忽略的问题顶了出来:当模型能力集中在少数几家闭源厂手里、而安全与数据治理的话语权分散在基础设施阵营,企业需要一层自己控制的访问与审计层,来确保调用模型时敏感数据和专有上下文不会不受控地沉淀到模型厂一侧。在 AgentsFlare 上运行 AI 流量的企业,请求级审计链、按用户与 endpoint 维度的调用记录、工具访问控制都在企业自己的控制平面里执行,模型可以换、可以多家并用,数据主权留在企业手上而不是随某一家模型厂的条款漂移。

欧盟启动 300 亿欧元算力工厂招标:算力主权变成招标文件

7 月 30 日,欧盟委员会正式启动 7 座 AI 算力工厂(AI Gigafactory)的招标,用 10 亿欧元公共资金撬动 20 亿欧元私人投资,目标总规模约 300 亿欧元,为初创企业、中小企业与产业界提供训练、推理和调优前沿模型的算力。项目分两档:4 座较小设施每座至少配 7.5 万张 AI 芯片、可获最高 5 亿欧元公共资金,3 座大型工厂每座至少 10 万张芯片、可获最高 10 亿欧元。投标于 11 月 12 日截止,预计 2027 年初决标、同年开工,明确目标是削减欧洲对美国和亚洲 AI 算力的依赖。

把这条和本周前几条放在一起,一个共同的动作浮现出来:物理算力正在成为战略资产,而争夺它的不只有企业。美国这边是芯片厂用资产负债表锁数据中心,欧洲这边是政府用公共资金建主权算力池。对在欧盟有业务的企业,这意味着未来两三年欧洲本地会多出一批不绑定单一美系云厂商的算力选项,区域部署和数据驻留的可选项在变多;但算力工厂 2027 年才开工,短期内欧洲的算力供给格局不会改变,真正可操作的是把这条纳入中长期的区域部署规划,而不是当下的采购决策。

算力上游信号:内存在涨、租金在跌,两条曲线第一次反向

本周上游最值得看的是两条方向相反的价格曲线。一条是内存:TrendForce 预测三季度服务器 DRAM(服务器内存,AI 服务器每张加速卡都要外挂大量 DRAM)合约价环比再涨 13–18%,而且由于多家美国云厂商此前已签多年长约锁定了价格上限,这一轮的涨价压力主要转嫁到没有长约的客户,以及长约客户在配额之外的增量采购上;HBM(高带宽内存,把多层内存芯片垂直堆叠、紧贴处理器封装的高速内存,是 AI 芯片的性能瓶颈之一)的合约价被预期在 2027 年成倍上涨,HBM4 将在 2026 下半年成为主流。另一条是 GPU 租金:7 月的租赁市场追踪显示,H100 按需租金已到历史低位、低端渠道每小时 1.38–1.49 美元,B200 按需约每小时 6 美元、竞价(spot)低至 2.12 美元。

市场信号在论证的传导路径是:内存受产能与长约结构约束、价格易上难下,尤其打在没有议价筹码的中小企业和新客户身上;而 GPU 租金因为供给方持续扩容、渠道竞争加剧而走低,租一张主流卡跑推理的边际成本还在下降。这两条曲线合起来对企业的含义是,推理成本的弹性目前主要来自算力租赁渠道而不是硬件本身——换一家供给方、把负载放到价格更优的渠道上,降本幅度大于等下一代卡;但前提是负载具备在不同供给方之间迁移的工程能力,被单一厂商的实例格式或软件栈锁住的负载享受不到这层红利。内存这条则是留给自建和长约谈判的变量:三季度之后没有长约保护的增量采购成本会明显更高,签长约的时点和额度值得重新算。

综合判断

把本周几条放到一起,模型层的相对安静反而让一条更深的主线显出来:算力的物理层正在被重新瓜分,而且下场争抢的三方——芯片厂、超大规模云、主权国家——过去都不直接持有这一层。英伟达当房东、AMD 用股权把自己嵌进 Anthropic、欧盟用公共资金建主权算力池,动作形态各不相同,指向的却是同一件事:谁掌握物理算力,谁就在下一阶段的议价里占位。与此同时,资本市场对这轮资本开支竞赛第一次集体表达怀疑,意味着这场瓜分不再是无条件加速,回报压力会开始反向影响云厂商的定价与配额行为。对企业,这几条合起来收紧成一个判断:AI 供应链的集中度正在从模型层向硬件与资本层下沉,单一厂商锁定的风险也随之从 API 账单沉到了物理算力的所有权结构里。在模型层保持多家并用、在硬件双栈之间保留调度弹性、把数据主权留在自己控制的一层,是应对这种结构性下沉最直接的对冲——本周英伟达安全联盟里那道基础设施阵营与闭源模型厂之间的裂缝,只是把这个一直存在的问题提前顶到了台前。

参考来源

Anthropic / Alibaba / OpenAI 等模型发布与定价:Best AI Models of July 2026ThursdAI July 2026 ReleasesLLM Updates — 2026-07

Qwen 3.7 Flash 发布与定价:Qwen3.7 Flash — OpenRouterQwen 3.7 Flash Complete Guide — 2026-07-27

GPT-5.6 低价档降价:OpenAI cuts GPT-5.6 Luna and Terra prices by up to 80% — QuartzOpenAI cuts prices for two of its GPT-5.6 AI models — CNBCAI price wars: OpenAI cuts GPT-5.6 Luna prices by 80% — VentureBeat — 2026-07-30

英伟达 Hut 8 德州数据中心租约:Nvidia Signs $50 Billion Lease with Hut 8 — GuruFocusNvidia behind $50 billion lease, FT reports — Yahoo Finance — 2026-07-28

AMD × Anthropic 50 亿美元投资与 2GW MI450:AMD and Anthropic Announce Strategic Partnership — AMD IRCNBC — 2026-07-22

AMD Helios 机柜发布:AMD Launches Helios — AMD NewsroomDCD — 2026-07-23

超大规模厂商 2026 资本开支与财报:Google/Microsoft/Meta/Amazon capex to hit $725B — Yahoo FinanceHyperscalers face higher capex scrutiny — CNBC — 2026-07

英伟达开放安全 AI 联盟:Industry Leaders Join Open Secure AI Alliance — NVIDIA BlogNvidia forms 37-member AI security alliance — CoinDesk — 2026-07-27

欧盟 AI 算力工厂招标:EU Pledges €10 Billion — BloombergEU opens applications for €10bn AI gigafactory scheme — Sifted — 2026-07-30

上游内存与 GPU 租赁价格:Server DRAM Contract Prices to Rise 13-18% QoQ in 3Q26 — TrendForceNVIDIA B200 Pricing (July 2026) — Thunder ComputeAI GPU Rental Market Trends (July 2026) — Thunder Compute — 2026-07