2026年第15周计算机行业周报:算力供需缺口仍存,国内提价与海外锁产共振

  • 来源:华西证券
  • 发布时间:2026/04/13
  • 浏览次数:68
  • 举报
相关深度报告REPORTS

计算机行业周报:算力供需缺口仍存,国内提价与海外锁产共振.pdf

计算机行业周报:算力供需缺口仍存,国内提价与海外锁产共振。一、国内提价信号密集落地,AI商业化从“低价换量”走向“能力重估”本周国内AI产业链最值得关注的变化,是云侧与模型侧同时出现价格上修信号。4月9日,腾讯云发布公告称,将自5月9日起对AI算力、容器服务及EMR相关产品刊例价统一上调5%;更早在3月11日,腾讯云已对部分模型结束免费公测并转入正式收费,同时上调混元系列模型价格。与此同时,智谱于4月7日发布新一代旗舰模型GLM-5.1,并同步出现提价信号。我们认为,国内云厂商与模型厂商连续提价,反映的并非简单价格策略调整,而是高性能算力资源、高...

算力供需缺口仍存,国内提价与海外锁产共振

一、 国内模型与云侧提价加速,算力与高质量

Token 稀缺性持续显现。 4 月 9 日,腾讯云发布公告称,将自 5 月 9 日起对 AI 算力、容器服务及弹性 MapReduce(EMR)相关产品刊例价统一上调 5%;更早在 3 月 11 日,腾讯云已对部 分模型启动正式收费并调整混元系列模型价格,其中 Tencent HY2.0 Instruct 输 入价格由 0.0008 元/千 tokens 上调至 0.004505 元/千 tokens。 与此同时,智谱于 4 月 7 日上线新一代旗舰模型 GLM-5.1,官方强调其在 Coding 与长程任务能力上进一步增强,可支持单次任务中持续工作 8 小时;伴随 新模型发布,市场信息显示智谱 GLM 再度提价 10%,其 Coding 场景缓存命中 Token 定价已接近海外头部模型水平。我们认为,国内云厂商与模型厂商同步提 价,反映的并非简单价格策略调整,而是高性能算力供给、高质量模型能力与企 业级调用需求共同作用下的阶段性再平衡,AI 基础设施供需关系已由过去的“以 价换量”逐步转向“能力溢价+资源稀缺”。

二、 海外锁产与长约继续前移,算力基础设施瓶颈向系统配套扩散

海外方面,Lumentum 首席执行官 Michael Hurlston 表示,受美国超大规模云 厂商资本开支持续扩张带动,公司光学组件需求明显加速,若按当前趋势发展, 再过两个季度,其 2028 年全年产能就可能彻底售罄;作为背景,公司此前已披露 到 2027 年底的产量基本被订完。与此同时,CoreWeave 在此前同 Meta 合作基础上 又达成新的扩展协议,到 2032 年 12 月向 Meta 交付约 210 亿美元的算力资源,并 继续获得 Anthropic 多年合作订单;英伟达新一代平台与 SK hynix 等配套环节的 协同展示,则进一步反映出海外 AI 基础设施建设正从单点算力采购走向整套系统 能力前置锁定。 我们认为,这一系列信号说明海外 AI 投资链条并未出现边际降温,相反,高 速光器件、云侧算力资源以及平台配套环节的紧平衡正在向更远期传导,算力系 统瓶颈已不只体现在 GPU 本体,也开始更多体现在网络、光模块、光芯片及相关系 统配套能力上。

算力供需缺口仍存,国内提价与海外锁产共振

2.1国内:腾讯云与智谱连续提价,AI 商业化从“低价 换量”走向“能力重估”

(一)腾讯云上调 AI 算力、容器与 EMR 价格,底层资源率先进入重定 价阶段

国内 AI 产业链本周最值得重视的变化,是云侧与模型侧同时出现价格上修 信号。4 月 9 日,腾讯云发布《AI 算力、容器服务、EMR 相关产品价格调整公 告》,明确将自 2026 年 5 月 9 日起,对 AI 算力、容器服务 TKE 原生节点及 弹性 MapReduce(EMR)相关产品刊例价统一上调 5%。从公告表述看,本轮调价 理由直接指向“全球 AI 算力需求持续激增”与“核心硬件供应链成本大幅上 涨”,并非单一产品升级或局部优惠策略调整。 这意味着,腾讯云此次并不是对单个模型或某一细分服务试探性提价,而是 将底层算力资源、容器调度与大数据处理资源纳入统一的价格上修框架中。我们 认为,这一点很关键:在传统云计算周期里,资源价格更多围绕规模扩张和市场 份额竞争展开;而在 AI 周期里,GPU 集群、训练推理调度、容器原生计算和数 据处理链条高度耦合,云厂商实际上是在对整套 AI 基础设施重新定价。本轮调 价本质上反映了高性能算力资源的稀缺性,而不是简单的商业涨价动作。 更值得注意的是,这已经不是腾讯云本轮周期内第一次调整价格。3 月 11 日,腾讯云智能体开发平台公告称,GLM 5、MiniMax 2.5、Kimi 2.5 等模型结束 限时免费公测并转为正式商用服务;同时,混元系列模型价格上调,其中 Tencent HY2.0 Instruct 输入价格由 0.0008 元/千 tokens 上调至 0.004505 元 /千 tokens,输出价格由 0.002 元/千 tokens 上调至 0.01113 元/千 tokens; Tencent HY2.0 Think 输入价格由 0.001 元/千 tokens 上调至 0.0053 元/千 tokens,输出价格由 0.004 元/千 tokens 上调至 0.0212 元/千 tokens。若以 HY2.0 Instruct 输入价格测算,其涨幅达到 463.13%。

从 3 月模型收费与涨价,到 4 月底层 AI 算力资源与配套服务上调 5%,腾 讯云在不到一个月时间里完成了“模型调用—底层资源”的连续价格修正。我们 认为,这背后对应的是 AI 商业化阶段发生变化:过去行业更强调降低调用门槛、 快速获取开发者和客户;而当企业级客户开始进入正式部署期,模型调用频率、 并发规模、长任务运行时长以及 Agent 场景下的工具链调用,都会持续推高底层 GPU/NPU、存储、网络和调度资源消耗,云厂商必须通过价格体系修复成本与供给 之间的失衡。腾讯云的动作,本质上是国内云厂商率先对 AI 资源紧平衡做出定 价反馈。进一步看,本轮价格调整的意义并不局限于单次涨价本身,而在于其反 映出国内 AI 商业化阶段的切换。过去一年,行业更强调通过免费公测、低价调用 和补贴策略快速吸引开发者与企业客户,核心目标是完成生态导入和调用习惯培 养;而当企业级部署逐步从测试验证走向正式上线,模型调用频次、并发规模、 上下文长度以及 Agent 场景下的多轮工具调用都显著上升,底层算力、存储、网络 和调度资源消耗同步抬升,云厂商开始更强调资源兑现效率与单位算力回报。也 就是说,AI 产业正在从“先做渗透率”逐步转向“兼顾渗透率与盈利能力”的新阶段。

(二)智谱 GLM-5.1 发布并提价,高能力模型开始兑现能力溢价

模型侧同样出现了清晰的“能力升级—价格上修”路径。4 月 7 日,智谱正式上线 GLM-5.1。根据智谱开放文档,GLM-5.1 的核心升级在于 Coding 能力大 幅增强、长程任务能力显著提升,并能够在单次任务中持续、自主地工作长达 8 小时;官方同时将其定位为构建 Autonomous Agent 与长程 Coding Agent 的理 想基座。 与此前“先降价、再拉量”的行业惯性不同,根据新浪财经报道,伴随 GLM5.1 发布,智谱 GLM 再度提价 10%;相关报道同时提到,调价后其在 Coding 场 景的缓存命中 Token 价格已接近海外头部模型水平。我们认为,这轮提价的重点 不在于单次涨幅本身,而在于其发生的时点:不是发生在能力平平、供给宽松的 阶段,而是发生在 GLM-5.1 实现“8 小时级持续工作”与强化长程任务闭环能力 之后。这说明国产模型商业化正在从“低价换调用量”逐步切换到 “性能换 ASP”。 从产业链视角看,模型侧与云侧同步提价,说明当前市场真正稀缺的并 不是模型数量本身,而是能够稳定支撑复杂任务、长上下文、多 Agent 协同和企业 级高并发调用的高质量供给。对下游客户而言,随着 AI 应用从简单问答走向代码 生成、工作流自动化和行业知识处理,模型可用性、稳定性与任务完成率的重要 性正在上升,价格敏感度则相对下降;对上游资源侧而言,高性能 GPU/NPU、推理 调度平台以及配套云基础设施的价值正在重新定价。我们认为,这种由能力升级 驱动的价格修复,意味着国内 AI 商业模式正从“低价获客”迈向“能力兑现”, 行业收入质量有望随之改善。 从行业层面看,腾讯云与智谱本周的连续动作具有共性:腾讯云上修的是底 层 AI 基础设施价格,智谱上修的是高端模型能力价格;前者反映“算力资源开 始变贵”,后者反映“高能力模型开始更值钱”。我们认为,两者共同说明,国 内 AI 行业虽然仍在快速扩容,但真正稀缺的不是模型数量,而是可稳定支撑复 杂任务、企业级并发和长任务闭环的高质量供给。AI 商业化正在从“低价换量” 转向“能力重估”,而这种价格修复本身恰恰说明供需缺口仍然存在。

(三)模型调用量持续抬升,需求侧扩张为算力价格修复提供支撑

根据 OpenRouter 最新数据测算,上周(3 月 30 日至 4 月 5 日)全球 AI 大模 型总调用量为 27 万亿 Token,环比增长 18.9%;其中,中国 AI 大模型周调用量 升至 12.96 万亿 Token,环比增长 31.48%,连续五周超过美国。报道同时提到, Qwen3.6 Plus(free)位居全球周调用量榜首,单周调用量达 4.6 万亿 Token。我 们认为,这说明国内需求侧并未降温,高质量 Token 消耗与推理负载仍在持续上 行,当前算力资源紧平衡并非只由供给侧提价驱动,而是有真实调用量扩张作为支 撑。换言之,国内 AI 商业化已不只是“模型更多、价格更低”的扩张逻辑,而是 开始进入“调用量持续放大—高质量推理资源更稀缺—价格体系跟随修复”的新阶 段。

(四)专家模式落地推动交互复杂度提升,单任务算力消耗继续抬升

DeepSeek 上线“快速模式”与“专家模式”,其中专家模式支持深度思考与智 能搜索,当前不支持文件上传与多模态功能,且高峰时段需排队等待。我们认为, 这类产品变化的意义不只是功能更新,而在于交互范式正在发生变化:从单轮问答 走向更复杂的问题求解与更长推理链条,意味着单次请求背后的推理时长、平均资 源占用和并发调度复杂度都在上升。也就是说,需求侧并非单纯“调用次数更 多”,而是“单次调用更重、任务复杂度更高”,这会进一步推高对高性能推理算 力和调度能力的需求。

2.2 海外:锁产与长约继续前移,算力基础设施瓶颈向 系统配套扩散

(一)Lumentum 远期锁产继续前移,光互连瓶颈进一步显性化

海外方面,本周最具指向性的变化来自光通信龙头 Lumentum。根据科创板日 报报道,Lumentum 首席执行官 Michael Hurlston 在东京表示,美国超大规模云 服务商的资本开支规模极其庞大,且目前仍看不到尽头;在当前需求趋势下,公 司在两个季度之内就可能把 2028 年底前的产能预订一空。作为背景,公司此前 已经表示,到 2027 年底前的产能基本已经被锁定。订单可见度从“卖到 2027 年”进一步前移至“两个季度后可能卖到 2028 年底”,我们认为,这说明 AI 基础设施相关需求并未出现边际降温,反而仍在加速确认。此外,从市场表现看, 部分海外光通信产业链公司估值与股价中枢已明显抬升,也在一定程度上印证了 AI 基础设施景气度的持续升温。 这一信号的重要性在于,它改变了市场对 AI 供给瓶颈的理解。过去讨论 AI 算力紧张,市场往往首先聚焦 GPU、HBM、先进封装、交换芯片等核心硬件;但 Lumentum 的表态表明,随着大模型集群规模不断扩大、云数据中心对高速互连带 宽需求持续抬升,支撑 GPU 集群高效运行的光器件和光互连环节本身,正在成为 新的约束点。Lumentum 供应的是先进磷化铟器件,用于高速数据传输,这类器件 直接服务于 AI 数据中心内部及跨机柜、跨集群高速连接需求。我们认为,当订 单提前锁到 2028 年,说明市场已经在为未来几年的网络侧扩容提前下单,而不 是只为短期 GPU 采购补库存。

公司扩产节奏同样说明供需矛盾的真实存在。根据公开报道,为满足激增需 求,Lumentum 在过去两年里已将日本工厂产能扩大 12 倍,但仍无法跟上需求增 长;公司当前计划继续向当地工厂追加投资。报道同时提到,由于磷化铟制造对 温度、湿度、搅拌速度和水质等变量要求极高,且围绕该材料形成的供应网络十 分关键,迁移生产地的难度较大。我们认为,这意味着光器件环节的扩产并不是 简单加设备就能完成,而是受到制造 know-how、供应链配套和产能迁移难度的共 同约束。从系统架构角度看,AI 算力瓶颈由 GPU 本体向光互连扩散,背后是大模 型训练与推理集群规模持续扩大所带来的必然结果。当单机柜、跨机柜乃至跨数 据中心的并行协同不断增强,决定整体效率的已不只是单卡算力水平,还包括节 点间通信带宽、时延控制以及数据传输稳定性。换言之,若网络侧和光侧无法同 步扩容,即使 GPU 持续上量,集群整体利用率也可能受到限制。因此,光模块、光 芯片、光器件及相关高速互连环节,正在从过去的“配套部件”上升为影响 AI 基 础设施建设节奏的关键变量,产业链景气度有望继续向网络侧与光侧上游传导。 我们认为,Lumentum 本周的表态,进一步强化了“AI 算力需求未见顶、网络 侧瓶颈更突出”的判断。短期看,海外超云资本开支仍在延续,高速光模块、CPO、 磷化铟等相关环节景气度维持高位;中期看,远期产能被锁定意味着产业链议价 权继续向具备技术壁垒、扩产能力与客户绑定能力的上游龙头集中。对于本轮 AI 基础设施周期而言,真正紧缺的并不只是算力芯片,而是支撑算力系统稳定运行 的一整套光、电、热、网协同基础设施。

(二)CoreWeave 连续获得 Meta 与 Anthropic 订单,云侧资源前置锁定加强

CoreWeave 于当地时间 4 月 9 日宣布,在此前合作基础上与 Meta 达成新 的扩展协议,到 2032 年 12 月向 Meta 交付约 210 亿美元的算力资源;报道同 时提到,CoreWeave 将在多个数据中心站点部署 Meta 专属容量,并包含部分首 批英伟达 Vera Rubin 平台。我们认为,这一事件表明海外头部客户当前锁定的 已不只是单点 GPU 资源,而是面向未来数年的整套 AI 基础设施能力,包括算力、 网络和机房侧配套资源。Lumentum 的远期锁产与 CoreWeave 的长单扩容相互印证,说明海外需求正在从“扩产验证期”进一步走向“资源抢占期”。 CoreWeave 宣布与人工智能公司 Anthropic 达成一项多年数据中心租赁协议, 用于支持 Anthropic 构建并部署 Claude AI 模型,相关计算资源将于今年晚些时候 开始分阶段上线,并有望在未来进一步扩展。报道同时提到,CoreWeave 所提供的 算力将涵盖其美国数据中心内部多种英伟达芯片架构,但双方未披露具体财务条 款。我们认为,在 Meta 之外,CoreWeave 继续获得头部 AI 客户多年合作订单,说 明海外 AI 基础设施需求并未边际降温,云侧算力资源仍在被持续前置锁定。

编辑:火腿肠
  • 相关标签
  • 相关专题
  • 热门文档
  • 热门文章
  • 本年热门
  • 本季热门
  • 本月热门
  • 本年热门
  • 本季热门
  • 本月热门
分享至