OpenAI 与 Anthropic 同月递交 S-1,Mythos 级模型 $10/$50 全面开放,服务器内存单季涨 95%
Author
AgentsFlare Research
Date Published
本周的主轴是三条线同时收紧。资本侧,Anthropic(6/1)与 OpenAI(6/8)在一周之内先后向 SEC 保密递交 S-1,前沿模型双雄同步走向公开市场,上期我们判断 650 亿美元 H 轮大概率是 Anthropic 上市前最后一次私募,一周内得到验证——上市意味着收入增长压力将持续通过 API 定价和企业套餐传导到客户侧。能力侧,Anthropic 在 6/9 把此前仅限少数机构使用的 Mythos 级能力以 Claude Fable 5 的形式全面开放($10/$50 每百万 token),同时 6/15 退役 Claude 4 代际,模型上新与退场的节奏都在加快;中国侧 MiniMax M3 以 5–10% 的成本对标 GPT-5.5。上游侧,内存成为本周最密集的信号源:服务器通用内存(DRAM)合约价单季上涨 90–95% 创历史纪录,AI 加速卡专用的高带宽内存(HBM)产能被预订到 2028 年,英伟达 6/8 在首尔与 SK 海力士签下多年期 HBM 共同开发协议。模型标价在下行,算力底座成本在上行,两条曲线的张力会决定未来几个季度企业拿到的真实价格。
- 前沿双雄同月递表: Anthropic 6/1 向 SEC 保密递交 S-1(6/2 选定 Morgan Stanley、Goldman Sachs 主承销,估值指向万亿美元量级);OpenAI 6/8 确认已保密递交 S-1,上市时间未定
- Claude Fable 5 全面开放(6/9): 首个普遍可用的 Mythos 级模型,定价 $10/$50(每百万 token 输入/输出),为 Mythos Preview($25/$125)的一半以下;同时 Claude Sonnet 4 / Opus 4 将于 6/15 在 API 退役
- GitHub Copilot 转向按用量计费(6/1): 套餐价不变,但每次交互按底层模型 API 费率折算 AI Credits;保留按请求计费的年付用户 multiplier 大幅上调(Opus 4.7 从 7.5x 升至 27x)
- MiniMax M3 发布(6/1): MSA 稀疏注意力 + 1M 上下文 + 原生多模态,官方称关键基准对标 GPT-5.5 / Gemini 3.1 Pro 而成本为其 5–10%;发布时权重未放出,承诺 10 天内开放
- OpenAI 接入 Oracle 云承诺(6/10): OCI 客户可用 Oracle Universal Credits 直接采购 OpenAI 模型与 Codex;Codex 周活用户超 200 万,三个月增长 5 倍
- 服务器 DRAM 合约价 Q1 环比 +90–95%(历史纪录)、Q2 预计再涨 58–63%;TSMC CoWoS 交期 78–104 周;英伟达与 SK 海力士签多年期 HBM 协议;美国 BIS 5/31 新规把先进 AI 芯片出口许可扩展至中国境外中资实体
AgentsFlare 是企业的 AI 控制平面——在模型、云与智能体不断分裂的环境里,替企业守住调用路由、成本归因与访问审计这条主动权。AI Infra Weekly 是 AgentsFlare 为企业用户推出的战略专栏,追踪全球 AI 基础设施层的关键变动。控制平面天然不押注任何单一模型或云,因此我们能不带立场地判断模型、算力与监管的结构性变动——在格局固化之前,先一步看清方向。
主要事件
Anthropic 与 OpenAI 同月递交 S-1:前沿模型定价进入公开市场审视期
6 月 1 日,Anthropic 向 SEC 保密递交 S-1 草案,次日确定 Morgan Stanley 与 Goldman Sachs 担任主承销商,市场对其上市估值的预期指向万亿美元量级;6 月 8 日,OpenAI 也确认已向 SEC 保密递交 S-1,并表示上市时间尚未确定、可能还需等待一段时间。上期简报曾关注 Anthropic 650 亿美元 H 轮并判断这大概率是其上市前最后一次私募,本周这个判断在七天内落地。两家公司在同一个月走到递表这一步,前沿模型行业的资本结构正式从私募驱动转向公开市场驱动。
对企业客户,这件事的传导路径很具体:上市公司每个季度都要向股东交代收入增长,而 API 定价、企业套餐结构和计费模式是模型厂商手里最直接的收入杠杆。今年以来的动作已经给出方向——GPT-5.5 将输入/输出价格提高至 $5/$30(翻倍),Anthropic 把企业客户从固定套餐转向按用量计费。递表之后,这类调整的频率和幅度只会受到更强的收入目标驱动。今天签下的价格条款,在供应商 IPO 周期里的稳定性需要重新评估。AgentsFlare 的多模型路由让企业在 Claude、GPT、Gemini 与开源模型之间按任务粒度保持切换能力,定价权博弈中不被单一供应商的资本周期绑定。
来源:Anthropic files to go public — 2026-06-06;Confidential submission of draft S-1 | OpenAI — 2026-06-08;OpenAI files for US IPO | Al Jazeera — 2026-06-08
Claude Fable 5 全面开放:Mythos 级能力下放,同时 Claude 4 代际加速退场
6 月 9 日,Anthropic 发布 Claude Fable 5,这是该公司第五代模型中首个普遍可用的版本,也是 Mythos 级能力第一次脱离 Project Glasswing 的受限准入框架向所有客户开放。此前 Mythos 级能力仅通过受限预览提供给少数机构,期间展示过跨操作系统与浏览器自主发现并串联零日漏洞的能力——TechCrunch 注意到,这次全面开放距 Anthropic 公开警示高能力模型风险仅数日,安全叙事与商业化在同步推进。定价上,Fable 5 为 $10/$50(每百万 token 输入/输出),高于 Opus 4.8 的标准档($5/$25),但只有 Mythos Preview($25/$125)的一半以下;Pro、Max、Team 与按席位计费的 Enterprise 计划可在 6/9–6/22 免费使用,之后转为消耗 usage credits。AgentsFlare 已同步接入 Fable 5,可直接评测。
同一周的另一半信息是退场:Claude Sonnet 4 与 Claude Opus 4(2025 年 5 月版本号)将于 6 月 15 日上午 9 点(太平洋时间)在 API 退役,此后对固定版本号的请求将直接返回错误。把两件事放在一起看,Anthropic 的代际管理节奏是头部能力加速下放、尾部版本加速清退,企业可用的迁移窗口持续缩短——从发布到旧版退役的间隔已经压缩到以周计。模型生命周期管理正在从年度规划题变成季度执行题。
来源:Claude Fable 5 and Claude Mythos 5 | Anthropic — 2026-06-09;Anthropic releases Claude Fable | TechCrunch— 2026-06-09;Claude Sonnet 4 and Opus 4 Deprecation | MindStudio — 2026-06
GitHub Copilot 转向按用量计费:固定订阅在前沿模型成本面前失守
6 月 1 日起,GitHub Copilot 从按请求计费切换为按用量计费。套餐名义价格不变(Pro $10/月、Pro+ $39/月、Business $19/用户/月),但每次交互改为按底层模型的 API 费率折算成 GitHub AI Credits 扣减;选择保留按请求计费的年付用户,高端模型的请求乘数大幅上调,Opus 4.7 从 7.5x 升至 27x。对依赖 Copilot Chat、agentic 编码会话和大上下文的团队,成本曲线发生实质变化——过去固定订阅吸收了前沿模型的真实推理成本,现在这部分成本直接穿透到了终端账单。
这是本周最值得记录的计费结构信号,因为它揭示了一个会复制到其他产品的模式:在前沿模型 API 成本居高且上游算力涨价的环境里,固定订阅定价对供应商不可持续,按量计费会从模型 API 层向上蔓延到开发工具、agent 平台和 SaaS 应用层。企业的 AI 支出正在从可预测的订阅项变成波动的用量项,6 月将是 Copilot 新计费的第一个完整账期,逐团队核对 token 消耗结构的窗口就在眼前。AgentsFlare 的成本归因与配额管理可以把这类波动按团队、项目、模型维度拆开,让预算重设有数据可依;而用量沉淀出规模之后,模型的计费档位往往也会随之松动,企业实际拿到的价格空间比账面价目表更大。
来源:GitHub Copilot Ends Flat Pricing June 1 | Enterprise DNA — 2026-06;GitHub Copilot pricing change | Apidog— 2026-06
MiniMax M3:成本对标 GPT-5.5 的 5–10%,但开源承诺缩水为 open weight
6 月 1 日,上海 MiniMax 发布 M3,技术路线上有三个看点:自研 MSA 稀疏注意力架构、最高 100 万 token 上下文、原生多模态输入(文本/图像/视频),定位长程编码 agent 工作负载。官方给出的基准声明是关键编码与推理基准追平或超过 GPT-5.5 与 Gemini 3.1 Pro,而调用成本仅为后者的 5–10%。延续中国开源阵营今年的节奏——4 月 DeepSeek V4 与 Kimi K2.6,6 月 MiniMax M3——前沿能力的开源供给仍在加密。
需要标注的是开放程度:发布时模型权重与技术报告均未放出,MiniMax 承诺 10 天内发布到 Hugging Face 与 GitHub;沿用 modified-MIT 许可,训练代码与推理算子不开放。在权重落地之前,所有基准声明无法独立验证;按目前的开放范围,M3 只够得上 open weight,距完整开源还差训练代码与算子两层。对评估自托管路线的企业,建议等权重与第三方复测落地后再做架构决策;如果 M3 的成本声明被验证,它将与 DeepSeek V3.2 一起继续压低开源侧的智能单价,给闭源厂商的定价策略增加一个实质性的锚。
来源:MiniMax M3 | MiniMax Research — 2026-06-01;MiniMax-M3 debuts | VentureBeat — 2026-06-01;MiniMax M3: Frontier Claims, Unverified Benchmarks | TechTimes — 2026-06-01
OpenAI 接入 Oracle 云承诺:云预算正式成为模型分发渠道
6 月 10 日,OpenAI 与 Oracle 宣布,OCI 客户未来数周内可将 Oracle Universal Credits 直接用于采购 OpenAI 模型与 Codex,无需单独的采购流程。配套数据是 Codex 当前周活用户超 200 万,三个月内增长 5 倍,月环比增速超 70%。这笔合作的机制值得拆开看:企业已经承诺给云厂商的预算,现在可以直接转化为模型与编码 agent 的消耗——采购摩擦显著降低,模型采购也随之被纳入云合同的结算与折扣体系。
这是生态整合信号在采购层的落地形态。模型厂商借云承诺获得了一条免谈判的进入企业的通道,云厂商则把模型消耗绑进了自己的采购承诺池,双方各取所需,而企业在合同期内的模型切换灵活性是这个结构里最容易被忽略的代价。用云额度采购模型之前,值得先确认两件事:一是合同期内能否调整模型组合,二是模型消耗能否按团队和项目拆分。第二件事的利害在于,额度扣减默认只在云账单里呈现为一笔总额,模型支出会和算力、存储等其他云支出混在一起——额度烧得比预期快时定位不到是哪个团队、哪条业务消耗的,内部分摊和预算问责没有依据,续约谈判时也拿不出自己真实的用量结构,只能被动接受云厂商给出的口径。AgentsFlare 作为独立访问层的价值在这个场景里很直接——模型选择权留在企业自己的路由规则里,不随任何一家云的承诺结构走;而承诺用量该换来的价格与服务保障,企业在 AgentsFlare 上按实际用量就能享受到,规模承诺的部分有人替你扛,不需要先把自己绑进某一家的合同里。
来源:Access OpenAI models and Codex through your Oracle cloud commitment | OpenAI — 2026-06-10
算力上游信号
本板块为本期新增:收录已被市场或机构论证过的产业链信号,按「信号—论证方—传导路径」呈现,不展开完整论证。入选标准只有一条:信号能传导到模型定价、算力可得性或企业部署成本。
HBM 正在被逐家锁定。 HBM(High Bandwidth Memory,高带宽内存)是直接封装在 AI 加速芯片旁边的专用内存——GPU 算力再强,数据喂不进来也只能空转,一张加速卡的实际推理吞吐很大程度由它决定,所以它是 AI 算力链上被抢得最凶的部件。6 月 8 日黄仁勋到访首尔,英伟达与 SK 海力士签署多年期 HBM 共同开发协议(两年起、可持续延展),并与 SK Telecom、Naver、斗山集团达成 AI 云与数据中心合作。背景是三大内存厂(SK 海力士、三星、美光)的 HBM 产能在 2026 年内基本售罄,多家分析机构估计需求年增 80–100% 而供给年增仅 50–60%,缺口延续到 2028 年甚至更晚。上期我们记录过另一半图景:Anthropic 的 H 轮把三星、SK 海力士、美光列为战略基础设施合作方。芯片厂、模型厂都在直接锁定内存供给,HBM 决定推理吞吐的成本下限,锁定关系决定谁能按什么价格拿到算力——这条传导链最终落在每百万 token 的 API 价格上。
DRAM 涨价已进入服务器与云的账单。 DRAM 是服务器的通用内存,每台云服务器都离不开它,与 AI 加速卡上的 HBM 出自同样的三家厂商、共用同样的产能。TrendForce 数据显示,服务器 DRAM 合约价 Q1 环比上涨 90–95%(历史纪录),Q2 预计再涨 58–63%,背景是三大厂把产能向 HBM 倾斜、北美云厂商加速 AI 推理部署并以长协锁定供给。行业预计 4–9 月服务器整机价格上涨 5–10%,内存密集型配置涨幅更高;云厂商会用毛利吸收一部分,其余通过实例价格、免费额度收缩或附加费转嫁。传导路径完整且已在发生:内存 → 服务器 → 云实例 → 推理成本 → API 与自托管 TCO。模型 API 的名义降价与算力底座的实际涨价正在同时进行。
先进封装仍是出货量的物理上限。 一颗 AI 加速器要把 GPU 芯片和 HBM 内存拼装到同一块基板上才能出厂,这道拼装工序就是先进封装,目前主要由台积电的 CoWoS 产线完成——芯片造得出来、拼不起来,照样出不了货。CoWoS 交期按不同机构口径在 50 周以上、最长估计达 78–104 周,产能从 2024 年底约 3.5 万片/月扩产至 2026 年底预计 12.5–13 万片/月,其中大部分已被英伟达预订。封装产能的扩张速度决定 2027 年全球 AI 加速器的供给增量,也决定 AMD 等第二供应商能拿到多少产能——上期 AMD 财报展示的算力第二曲线,物理上限在这里。
市场已在交易瓶颈逻辑,信号与反信号并存。 资本市场对上述瓶颈的定价相当充分:费城半导体指数 4 月 24 日创历史新高,半导体 ETF 截至 5 月底年内涨幅超过 50%,市场上流行的论证框架是找出产业链中供给最受限的环节、押注该环节供应商的定价权——内存与封装正是这个框架下被反复点名的位置。同时存在反向信号:GPU 租赁市场部分价格段开始松动,有分析师提示板块估值已经计入了过于完美的预期。监管侧,美国 BIS 于 5 月 31 日发布新指引,将先进 AI 芯片的出口许可要求扩展至总部或最终母公司位于中国(含澳门)的境外实体,封堵借第三地采购的通道;中国侧的对应变化是国产算力份额继续上行,IDC 等机构预计华为 2026 年将占中国 AI 芯片市场约 50%。我们记录这些信号的理由是它们到模型层的传导路径真实存在;至于股价层面的判断,不在本专栏的范围内。
来源:NVIDIA South Korea AI deals — 2026-06-08;AI Server Demand to Drive Memory Contract Price Increases in 2Q26 | TrendForce — 2026;DRAM prices predicted to jump 63% in Q2 | Tom's Hardware — 2026;TSMC Foundry Allocation Status Q1 2026 | Silicon Analysts — 2026;美国升级AI芯片出口管制 | 新浪科技 — 2026-06-01
本周结构性判断
把模型层与上游放在同一张图上看,本周呈现的是两条方向相反的成本曲线。模型层的单位智能价格在下行:Mythos 级能力从 $25/$125 降到 $10/$50 全面开放,MiniMax M3 声称以 5–10% 的成本对标闭源旗舰。算力底座的成本在上行:DRAM 单季涨 90–95%,HBM 缺口看到 2028 年,服务器整机价格下半年预涨 5–10%。两条曲线不会简单抵消,它们会以更频繁的价格结构调整的形式释放张力——降价、涨价、计费模式切换会在同一个季度里并存,Copilot 从固定订阅转向按用量计费是第一个清晰的样本,递表后的 OpenAI 与 Anthropic 有更强的动机跟进类似调整。企业 2026 下半年面对的将是一张波动加大的价格表,预算管理方式需要从年度锁定转向季度滚动。
供应链的另一个变化是锁定关系在向上游延伸。模型厂商直接入股或绑定内存厂(Anthropic H 轮的三星/SK 海力士/美光),芯片厂商与内存厂签多年期协议(英伟达与 SK 海力士),云厂商用采购承诺池绑定模型分发(Oracle 与 OpenAI)。每一层都在用长期合同换确定性,而这些合同的成本最终会沉淀进企业采购的每一个价格里。供应链上谁锁定了谁,决定了未来两年价格传导的路径和速度。
企业行动指南
针对本周事件,五件事有明确的时间窗口。第一,6 月 15 日前盘点所有固定版本号调用 Claude Sonnet 4 / Opus 4 的服务,退役后这些请求直接报错,属于生产事故级风险。第二,6 月 22 日 Fable 5 免费窗口结束前完成评测,但预算测算按 $10/$50 计入,按免费期体验做的成本承诺都会失真。第三,6 月是 Copilot 按用量计费的第一个完整账期,月底逐团队核对 token 消耗结构,重设配额,特别关注 agentic 长会话的消耗占比。第四,把内存与服务器涨价计入 2026 H2 的自托管推理 TCO,重新计算 API 与自建的成本平衡点——上游涨价对自托管路线的侵蚀比对 API 路线更直接。第五,评估用 Oracle credits 采购 OpenAI 之前,确认合同期内模型组合的调整条款与消耗数据的归因粒度。
模型在变快、价格在变动、上游在锁定,企业唯一可控的是自己的访问层。把路由规则、成本归因和切换能力握在自己手里,价格波动就停留在参数层面,到不了架构重构那一级。
候选标题(供选择)
事件驱动型:OpenAI、Anthropic 同月递交 S-1,Mythos 级模型 $10/$50 开放,DRAM 单季暴涨 95%——定价压力从资本和上游两头逼近
判断型:模型在降价,底座在涨价:双 S-1 与内存缺口夹击下的企业 AI 预算
结构性洞察型:前沿模型双双递表、HBM 被预订到 2028、Copilot 改按量计费:企业 AI 的价格条款要从两头重新谈
简洁有力型:S-1 递表、Fable 5 开放、内存涨价:三件事改写下半年 AI 预算
参考来源
Anthropic / OpenAI S-1
Confidential submission of draft S-1 to the SEC | OpenAI — 2026-06-08
Tech giant OpenAI files for US initial public offering | Al Jazeera — 2026-06-08
Anthropic files to go public in a potentially trillion-dollar debut | Pearson Finance News — 2026-06-06
Claude Fable 5 / Claude 4 退役
Claude Fable 5 and Claude Mythos 5 | Anthropic — 2026-06-09
Anthropic releases Claude Fable, a version of Mythos | TechCrunch — 2026-06-09
Anthropic brings Mythos to the masses with Claude Fable 5 | VentureBeat — 2026-06-09
Claude Sonnet 4 and Opus 4 Deprecation | MindStudio — 2026-06
GitHub Copilot 计费切换
GitHub Copilot Ends Flat Pricing June 1 | Enterprise DNA — 2026-06
GitHub Copilot pricing change | Apidog — 2026-06
MiniMax M3
MiniMax M3: Frontier Coding, 1M Context, Native Multimodality | MiniMax Research — 2026-06-01
MiniMax-M3 debuts, eclipsing GPT-5.5 and Gemini 3.1 Pro on key benchmark performance | VentureBeat — 2026-06-01
MiniMax M3 Open-Weight Coding Model: Frontier Claims, Unverified Benchmarks | TechTimes — 2026-06-01
OpenAI × Oracle
Access OpenAI models and Codex through your Oracle cloud commitment | OpenAI — 2026-06-10
算力上游信号
NVIDIA Secures Six Deals with AI Tech Giants in South Korea | AI Magazine — 2026-06-08
Nvidia locks down Korean memory deals as HBM shortage runs through 2028 | gagadget — 2026-06
AI Server Demand to Drive Memory Contract Price Increases in 2Q26 | TrendForce — 2026-03-31
DRAM prices predicted to jump 63% in Q2, NAND up to 75% | Tom's Hardware — 2026
Server Price Increases in 2026 | Hostkey — 2026
TSMC Foundry Allocation Status Q1 2026: N3 Fully Booked, CoWoS 50+ Weeks | Silicon Analysts — 2026
The Great Packaging Pivot: How TSMC is Doubling CoWoS Capacity | FinancialContent — 2026
Semiconductors in 2026: The AI-Driven Upswing Meets Structural Bottlenecks — 2026
Data-Center Power Constraints: The Critical AI Growth Threat | SquaredTech — 2026
美国升级AI芯片出口管制,堵截中国境外子公司 | 新浪科技 — 2026-06-01
美国商务部周末急发新规 | 美国之音 — 2026-06-01