特朗普总统联大斥AI监管为全球主义阴谋,两日后Altman与Amodei转向联合国安理会;DeepSeek押注华为芯片,Opus 5.5降价四成迎战Grok 4.7
特朗普在联合国反对国际AI监管,Altman与Amodei随后向安理会呼吁全球安全标准,前沿模型发布节奏的分歧公开化。与此同时,文中称DeepSeek将下一代模型训练转向华为等国产芯片;Anthropic推出Claude Opus 5.5,典型工作负载成本较Opus 5降低40%,xAI发布Grok 4.7
9 月 22 日,特朗普总统在联合国大会演讲中把国际AI监管称为全球主义阴谋,称不会让一件比工业革命更伟大的事物的成长受到阻碍,并把安全倡导者与气候警告者归为一类。不到 48 小时后,9 月 23 日下午,OpenAI 的 Sam Altman 与 Anthropic 的 Dario Amodei 先后向联合国安理会发言,呼吁建立全球性的AI安全标准与事件报告机制,Amodei 承诺 Anthropic 将按需放慢发布节奏,一项没有约束力、只约束自己的单方面承诺。同一周,习近平主席对华盛顿进行国事访问,英伟达对华芯片销售仍是零:H200 去年 12 月已获批,至今未有芯片运抵中国,原因是美方要求芯片只能在中国境内使用,北京却要求本国企业把英伟达芯片用于海外业务,两条规则互斥,谁也不让步。在中国一侧,DeepSeek 创始人梁文锋告诉投资者,把下一代模型的训练迁至华为与国产芯片,已是公司的首要任务。过去一周的结构性变化在于:AI 治理的分歧不再停留在实验室与国会的措辞之争,而是被搬上了特朗普总统本人与联合国的讲台,两种立场都摆在了台面上,谁也没有说服谁;与此同时,算力的供给侧仍沿着各自的路径往前走,美方的芯片卡在政治规则里,中方的芯片卡在产能与效率里,模型层的定价战则完全没有等这两件事分出结果。
AgentsFlare 是企业的 AI 控制平面——在模型、云与智能体不断分裂的环境里,替企业守住调用路由、成本归因与访问审计这条主动权。
AI Infra Weekly 是 AgentsFlare 为企业用户推出的战略专栏,追踪全球 AI 基础设施层的关键变动。控制平面天然不押注任何单一模型或云,因此我们能不带立场地判断模型、算力与监管的结构性变动——在格局固化之前,先一步看清方向。
联大讲台上的骗局论,与联合国安理会里的求援
9 月 22 日,特朗普总统在联合国大会发表演讲,将国际AI安全监管称为全球主义阴谋,称“我不会阻碍一件比工业革命更伟大的事物的成长”。他把警告AI风险的人与气候变暖警告者归为一类,此前已在 Truth Social 上称生存性威胁的说法是骗局,并表示唯一需要的安全措施是特朗普总统本人足够聪明。这与他 9 月 14 日致电英伟达 CEO 黄仁勋时的表态一致,当时他称数据中心建设的反对声音是骗局,反对者只是在帮竞争对手的忙。
不到 48 小时后,9 月 23 日下午,Altman 与 Amodei 先后向联合国安理会发言,Amodei 以视频方式参加。Amodei 的发言分两层:AI 对科学与医疗的潜在益处,以及生物武器开发或系统失控的风险。他承诺 Anthropic 将根据需要放慢新版本的发布速度以确保安全,但这只是公司单方面的表态,不约束任何竞争对手或政府,也未说明触发延迟的具体风险标准,更未建立外部机构对发布决策的否决权;他同时提议建立全球性的模型测试标准与生物武器开发禁令,均为倡议性质。Altman 则呼吁建立“快速事件报告”机制与“关于防护与监督的全球协议”,并特别强调标准不应锁定现有巨头或偏向某一种商业模式,必须同时支持开源与闭源、新进入者与既有实验室。同场发言的还有 Hugging Face CEO Clément Delangue,他主张决策不应被恐惧驱动;微软总裁 Brad Smith 则支持独立评估者与人类控制机制。
这是 9 月 12 日 Amodei 发文提议放慢前沿速度以来,这场讨论首次被搬上联合国的讲台,也是首次在不到两天内被特朗普总统本人在同一个国际场合直接否定。落到企业侧,能确认的仍是同一个结论:节奏由谁定,没有答案;能落地的只有各家实验室自愿的披露与评估承诺,以及日后可能进入合同附件的审计条款。而这些条款覆盖哪些模型、由谁核验,取决于企业自己与供应商谈下来的条款,不取决于联合国这场发言。
习近平主席访美两天,英伟达对华芯片仍是零出货,DeepSeek把下一代模型押注华为
同一周,习近平主席对华盛顿进行国事访问,OpenAI 的 Altman、英伟达的黄仁勋与苹果董事长 Tim Cook 出席相关国宴活动。美国贸易代表 Jamieson Greer 明确表示,此次峰会期间半导体管制问题“根本没有被讨论”。国会一侧,参议院少数党领袖舒默要求特朗普总统“划出硬线”,指责其向中国交付了AI技术;参议员沃伦则主张通过立法而非行政协议确定政策,并批评黄仁勋等企业高管深度参与谈判。三项拟议的出口管制法案已被纳入国防授权法案的经理人修正案,但因伊朗战争与五角大楼预算的分歧被搁置,除 Anthropic 外,主要AI企业与芯片供应商均反对这些法案,称其会阻碍创新。白宫的回应是,现行体制已是“现代历史上最严格的出口管制制度”。
英伟达 H200 去年 12 月已获美方有条件出口批准,阿里巴巴、腾讯、字节跳动、京东等约 10 家中国企业各自获得最多 7.5 万块的进口许可,联想与富士康被指定为分销商,但至今没有芯片运抵中国:美方规则要求芯片只能在中国境内使用,北京则要求本国企业把英伟达芯片的使用限定在海外业务,转而支持国产芯片,两条规则互斥,谁也无法满足对方的条件。英伟达在华季度营收占比已从两成以上降至约 5%,在中国AI加速器市场的份额,用黄仁勋自己的话说,已经“接近于零”。
正是在这一背景下,DeepSeek 创始人梁文锋告诉投资者,把下一代模型的训练迁移至华为与国产芯片,是公司当前的首要任务。华为计划在 2026 年第四季度至 2027 年第一季度向 DeepSeek 交付新一批定制加速器,昇腾 950DT 预计年底前到货,昇腾 960DT 则于 2027 年一季度首次亮相,与华为轮值董事长汪涛上周公布的、提前三个季度的路线图一致。DeepSeek 正在训练一个 2 万亿参数的模型,约为已发布的 V4(1.4 万亿参数)的 1.5 倍,长期目标是 8 万亿参数。梁文锋给出的效率对比很直接:用英伟达 GB300 训练一个 OpenAI 级别的模型大约需要 5 万块芯片,换成昇腾 950 则需要约 20 万块,是前者的四倍。他判断华为的AI芯片会在几年内追上英伟达,但眼下这笔账仍是拿数量换自主:以四倍的芯片规模,换一条不受出口管制约束的训练路径。
对企业侧的含义很直接:中美两侧的算力供给都不再由单一变量决定。美方的芯片受制于两国互斥的使用规则,短期内无解;中方的芯片受制于绝对产能与单位效率,用规模弥补代际差距是当前唯一可行的路径。两条路径指向同一个结论:模型层的算力成本结构,在未来一到两年内不会因一次峰会或一项法案而稳定下来。
Opus 5.5 降价四成,Grok 4.7 原价扩容,Gemini 4 被迫提前交卷
9 月 21 日,xAI 发布 Grok 4.7,维持与 Grok 4.6 相同的每百万 token 输入 2 美元、输出 6 美元定价,但换用了全新的更大基础模型,而非在 4.6 上微调,上下文窗口扩大至 50 万 token,并加强了长文本自我验证能力。在 Terminal-Bench 4.0 上,成绩从 4.6 版本的 20.3% 跳升至 38.0%,在 Harvey 法律智能体测试与 EEBench 上同样领先;安全测试中,仅 3.3% 的高风险双重用途提示成功绕过防护。次日,9 月 22 日,Anthropic 发布 Claude Opus 5.5,输入价格降至每百万 token 4 美元、输出 20 美元,较 Opus 5 各降 20%,缓存读取价格降 60%,典型工作负载的综合成本降幅达 40%。Anthropic 称其为“新的领先模型”,在 Terminal-Bench 4.0 上取得 66.4%(Opus 5 为 52.3%),知识类任务 Elo 评分 1846(Opus 5 为 1708),越权规避行为的发生率下降 85%。
两天之内,两家实验室用完全不同的方式回应了同一种压力:xAI 保持价格不变,换更大的模型多给性能;Anthropic 保持模型定位不变,把价格砍低四成。这场定价战直接把 Google 推到了台前。9 月 23 日至 24 日,在 The Information 的 AI Agenda Live 峰会上,8 月刚升任 Google DeepMind 高级副总裁的 Koray Kavukcuoglu 透露,Gemini 4 已进入早期后训练阶段,目标是“尽快”发布,明显早于此前设定的年底节点。Gemini 4 于 7 月 21 日开始预训练,两个月内即进入后训练,速度快于 Gemini 3.5 Pro 自 6 月以来的长期测试周期。但现有差距不小:按 Intelligence Index 评分,Gemini 3.6 Flash 为 34.0 分,GPT-6 Sol 为 47.5 分,GPT-6 Astra 为 52.7 分,Opus 5.5 为 57.6 分,Google 当前最强模型与 Anthropic 前沿模型相差 23 分。加速发布与其说是节奏自主的选择,不如说是被 9 月 21 日至 22 日这场定价战倒逼的结果。
三条产品线在同一周分别选择了降价、扩容与抢跑,说明前沿模型的价目表与性能排位正在按周变化,而非按季度。企业如果把模型选型写死在合同里,很快会发现自己仍按旧价目表和旧基准在做预算。AgentsFlare 的多模型路由按任务类型、成本预算与 SLA 动态调度,模型层的排位变化不需要企业逐一重新评估合同,路由策略随价目表更新即可完成切换。
甲骨文对新墨西哥数据中心发出不可抗力通知,180 亿美元贷款打九折
9 月 24 日,甲骨文就其新墨西哥州的 Project Jupiter 数据中心项目发出不可抗力通知,理由包括水资源与空气许可诉讼的持续延迟、电力方案被迫从燃气轮机改为 Bloom Energy 燃料电池的重新设计,以及融资端的压力与不确定性。这座占地 1400 英亩的园区原计划用于支撑甲骨文云基础设施与 OpenAI 的 Stargate 项目算力需求,原定 2027 年上半年开始交付,如今时间表面临滑移,施工方、设备供应商、贷款人与 OpenAI 都将面对新的不确定性。项目于 2025 年 9 月启动,尽管现场有数千名建筑工人,到 2026 年 9 月初的建设完成度仅约 26%。新墨西哥州最高法院已于 9 月 17 日驳回环保组织的紧急禁令请求,但更广泛的许可诉讼仍未了结。
这笔约 180 亿美元的银团贷款在二级市场的交易价格已跌至每美元 89 至 91 美分,意味着市场已为潜在损失计入 16 亿到 20 亿美元的风险溢价,部分原因是甲骨文的信用评级今年 7 月被下调至 BBB-,仅高于垃圾级一档。甲骨文官方仍表示项目按计划推进,其 2026 财年云收入达 340 亿美元,同比增长 39%。这是过去一周里第二个提醒企业买方的信号:算力的账面承诺与实际交付之间存在相当大的时间差,且这个时间差本身正被资本市场重新定价。对于把算力保障写进采购合同的企业而言,单一供应商、单一园区的执行风险,与模型层的降价周期一样,都需要在预算里留出缓冲。AgentsFlare 的跨云路由允许同一策略覆盖 AWS、Azure 与私有部署,某一区域或某一供应商的交付延迟,不会拖住企业的整条业务线。
算力上游:AMD 市值破万亿,云端算力涨价 17%–41%
9 月 21 日,AMD 市值突破 1 万亿美元,成为第四家跨过这一门槛的美国芯片制造商,带动因素包括 Meta 旗下 Muse 助手登顶苹果应用商店免费榜、存储芯片需求旺盛,以及韩国芯片出口连创纪录。同日,一份未经证实的供应链渠道报告称,AMD 计划从第四季度起将AI加速器、消费级GPU与主板芯片组价格统一上调约 10%,原因是代工方台积电的晶圆成本上升;AMD 未证实该报道,但股价当日一度上涨 5%,英伟达与台积电同步走高,费城半导体指数上升 2%。涨价传闻尚未被证实,市场却已先按真消息交易了一轮,说明芯片供给紧张已是投资者的默认假设,无需官方确认便会反映到股价里。
价格传导已落到云端账单上。GPU 云厂商 Nebius 于 9 月 17 日宣布,自 10 月 1 日起上调服务定价:GPU 上涨 17% 至 21%,CPU 上涨 25%,内存上涨 41%。TrendForce 此前的月度简报显示,高带宽内存的合约谈判因下一代计算平台规格未定而陷入僵局,价格仍有明显上行空间,PC DRAM 的季度合约涨幅预期也被上调。芯片端的涨价预期与云端已落地的涨价指向同一条传导链:晶圆代工成本与内存供给的紧张,正从芯片报价单经由云厂商账单,传导至企业每月的算力开支,而这条链条眼下还未传到模型层的 API 定价。对于按团队与项目设定 token 预算的企业,上游价格每一次上调都需重新核对哪些团队在用哪一档模型、实际成本花在了哪里;AgentsFlare 的配额管理与按 endpoint、用户、团队、模型四维度的成本归因,正是为了让这类核对不必等到月底账单出来才做。
特殊洞察:推理云的估值,三个月翻了一倍
Baseten 是一家为没有内部基础设施团队的公司提供推理部署与运维服务的美国公司,客户包括 Abridge、Clay、Cursor、OpenEvidence、Mercor 与 Notion。9 月 22 日,Axios 援引消息称,Baseten 正在接触投资人,商谈以约 260 亿美元估值融资,而这距其 6 月完成的上一轮融资、约 130 亿美元估值,只过去了三个月;更早的 2 月,其 E 轮融资额为 3 亿美元、估值 50 亿美元,由 IVP 与 CapitalG 领投,英伟达参与。Modal Labs 是一家面向计算工作负载的代码优先平台,让开发者无需自行管理基础设施即可在云端运行代码,2026 年初的年化经常性收入约 5000 万美元。同一时间,市场信号显示 Modal 正在商谈约 150 亿美元估值的新一轮融资,而其上一轮公开披露的融资是 2025 年 9 月的 8700 万美元 B 轮、估值 11 亿美元,不到一年时间估值上涨约 14 倍;最近一次约 50 亿美元的估值传闻出现在约 4 个月前。两轮融资均仍在商谈阶段,具体投资人与最终条款尚未披露。
两家公司的业务并不相同:Baseten 做的是托管推理的运维层,Modal 做的是更底层的计算执行环境,但资本市场给出的信号一致——把模型从代码变成可靠服务的这一层,正被当作与模型本身同等重要的基础设施来定价。业务牵引力上,Baseten 已有多个知名企业客户在用,Modal 有确定的年化收入规模,两者都不是单纯靠叙事撑估值;但短短三到四个月内估值翻倍甚至翻十余倍,也说明这一层的定价目前主要由一级市场的情绪而非营收倍数决定,值得持续观察下一轮融资能否真正落地、条款是否兑现当前的报价。
谁的节奏,谁的芯片,谁的账单
过去一周,三件事分别揭示了AI基础设施三层的真实状态。治理层,联合国的讲台证明了一件事:无论是特朗普总统的骗局论还是实验室的自愿承诺,都无法单方面定义AI的发展节奏,能落地的只有企业自己与供应商谈下来的审计条款。算力层,中美两侧的芯片供给分别卡在政治互斥规则与代际效率差距里,谁都无法在短期内绕开自己的约束,DeepSeek 用四倍芯片换自主的选择,本质上是拿时间换空间。资本层,模型的定价与性能在按周重排,推理云的估值在按季度翻倍,两者共同说明这个行业的资产重估速度,已快过大多数企业内部预算周期能跟上的速度。
三层各自的节奏都不由企业决定,企业能决定的只有一件事:把用哪个模型、多快能换、每一分钱花在哪这几个变量,放进自己能控制的系统里,而非写死在某一家供应商的路线图里。