券商观点|从Kimi K3迈入2.8万亿参数到海外模型密集升级:Scale Up跨柜扩展提速,光互联需求打开新增量域
2026年7月27日,东方证券发布了一篇通信行业的研究报告,报告指出,Scale Up跨柜扩展提速,光互联需求打开新增量域。
报告具体内容如下:
国内外前沿模型进入新一轮密集迭代期,ScalingLaw转向“更大基座、更长上下文、更强Agent与更多推理计算”共同扩张。2026年7月16日,月之暗面发布KimiK3,总参数规模达到2.8万亿,并支持100万Token上下文和原生视觉理解,成为国内大模型重新向超大规模基座演进的标志性事件。海外模型方面,OpenAI于7月推出GPT-5.6,新增更高推理强度及多Agent并行模式;Anthropic先后发布Fable5、Mythos5及7月24日上线的Opus5,持续强化复杂编程、科研和长程自主任务;Google最新Gemini3系列也将百万Token上下文、原生多模态和Agent能力作为重要方向。由此来看,模型竞争并未从Scaling转向“小模型替代大模型”,而是从单一预训练参数扩张,演变为总参数、激活参数、上下文长度、测试时计算和Agent并发数量的共同提升; 模型有效工作集扩大和Agent任务复杂度的提升,正在系统性抬高大ScaleUp域的价值,多机柜ScaleUp将成为未来AI系统演进的核心方向。对MoE模型而言,真正影响通信需求的不只是总参数规模,而是专家数量、激活参数、ExpertParallelism和模型并行组规模。Token需要在不同专家之间持续完成Dispatch和Combine,天然产生高频All-to-All通信;当专家并行组超过单机柜能够高效容纳的范围后,越来越多通信将跨越机柜边界。扩大ScaleUp域,可以将更多专家、张量并行组和KVCache资源留在统一的低时延、高带宽计算域内,提高计算通信重叠效率和GPU利用率。而单机柜继续增加GPU数量,已经受到功耗、供电、液冷、空间、重量、布线及高速电连接距离的共同约束。英伟达最新VeraRubin平台已明确提出POD-scaleup系统,使多个机架作为一个大型协同系统运行;NVLink6也进一步面向MoE、专家并行和低时延All-to-All通信优化。我们认为,AI计算的基本单元正在由服务器升级至机柜,并进一步由单机柜走向多机柜GPU互联; 多机柜ScaleUp将确定性推动柜间链路光化,并为NPO、CPO及高密度光连接打开新的需求空间。单机柜内部距离较短,铜背板、DAC和AEC仍具备成本、功耗和维护优势;但当ScaleUp域跨越多个机柜后,互联距离、端口数量及带宽密度明显提升,纯电连接将面临插损、均衡、Retimer功耗、散热和信号完整性等约束。而CPO通过将光电转换靠近交换芯片,可明显缩短高速电路径并降低每比特功耗。由此来看,多机柜ScaleUp带来的第一层确定性,是“柜内以铜为主、柜间加速光化”;第二层趋势,是光电转换位置持续向交换ASIC靠近,推动板载光学、NPO和CPO在高带宽密度节点逐步提高渗透率。具体方案仍可能呈现电连接、可插拔光模块、NPO与CPO长期并存,但光互联由传统ScaleOut网络进一步进入ScaleUp计算域内部的方向已经较为清晰。
投资建议:随着前沿模型参数规模、专家并行度和Agent推理复杂度持续提升,ScaleUp域由单柜向多柜扩展的趋势有望加速,柜间高速互联光化将成为AI基础设施升级中的高确定性方向。建议重点关注受益于NPO/CPO渗透率提升的光引擎、硅光芯片、FAU/MPC、高密度光连接器、保偏光纤及精密耦合封装等产业链环节。
相关标的:中际旭创(300308)(300308,未评级)、天孚通信(300394)(300394,未评级)、致尚科技(301486)(301486,未评级)、长盈通(688143,未评级)
风险提示
AI资本开支增长不及预期;前沿模型Scaling进展不及预期;CPO/NPO产业化进度不及预期等风险。
声明:本文引用第三方机构发布报告信息源,并不保证数据的实时性、准确性和完整性,数据仅供参考,据此交易,风险自担。
所有文章未经授权禁止转载、摘编、复制或建立镜像,违规转载法律必究。
举报邮箱:1002263188@qq.com