
光学互联这两年是被AI算力硬生生抬到台前的但真正卡脖子的往往不是光口速率本身而是调制器能不能在功耗和体积的天花板下顶住带宽需求。HyperLight这次在TFLN Chiplet平台推出每通道400G的PIC把薄膜铌酸锂TFLN、芯粒Chiplet、光子集成电路PIC三个词绑到了一起瞄准的是下一代人工智能互连。这事对从事800G、1.6T光模块、光引擎或者AI集群网络架构的人来说都值得仔细看一眼。简单来说这件事解决的是AI集群里“光互连带宽追不上GPU算力扩张”的错配问题。过去多通道并行堆速率的路子还在但单通道速率上不去就意味着更多激光器、更多调制器、更多功耗。HyperLight的思路是用TFLN做调制器以Chiplet形式封装成PIC把每通道速率推到400G。这篇内容适合光通信工程师、模块厂商产品规划、AI数据中心网络架构师以及想判断下一代光器件方向的投资和技术决策者阅读。1. 这项发布究竟做了什么平台、器件与400G的真实含义1.1 TFLN是什么为什么它总被当成“下一代材料”TFLN是薄膜铌酸锂Thin-Film Lithium Niobate的缩写。铌酸锂本身不是什么新鲜材料体铌酸锂调制器在高端通信里用了很多年特点是电光系数高、带宽大、 chirp低100G时代的相干光模块里大量使用。问题在于体材料波导结构尺寸大、半波电压高、难以与激光器或其他有源器件做高密度集成做成商用模块往往体积可观、成本居高不下。薄膜化之后铌酸锂被做成几百纳米厚的单晶薄膜再通过刻蚀形成脊型波导光场被限制在亚微米量级的截面里。这样一来调制效率和集成密度都大幅提升同时保留了铌酸锂本身的高线性度和超高带宽优势。做调制器的人都知道材料决定物理天花板硅光调制器在带宽和线性度上可以做到“够用”但当每通道速率往200G、400G走的时候硅的载流子色散效应、EML的啁啾问题都会把做链路预算难度拉高一大截。TFLN属于那种“天生为高频而生”的材料这也是HyperLight敢在这个时间点把每通道400G推到台前的原因。1.2 Chiplet在光电子领域不是噱头是工程现实Chiplet这个词是从电子芯片封装领域火起来的意思是把大芯片拆成不同功能的小芯粒再用先进封装拼成一个系统。在电子领域它解决的是良率、复用和异构集成问题。HyperLight管自家平台叫TFLN Chiplet本质上就是把TFLN调制器、无源光路、可能还有激光器、驱动电路等按芯粒的方式做模块化组合。这个命名不是蹭热点。光模块由分立器件转向共封装光引擎CPOCo-Packaged Optics后需要的不再是一整颗完整PIC而是可以灵活组合的光学子单元。调制器作为一个chiplet出片再与激光器chiplet、DSP die放进同一封装体能大幅提升单个PIC的通用性和迭代速度。如果你手头有做光电共封装的背景应该能理解这种做法的杀伤力过去换一个调制器方案等于重新流片整个PIC现在只需要换对应chiplet。1.3 每通道400G意味着什么当前主流的AI集群光互连正处在单通道200G向400G迁移的节点。800G DR8模块采用单通道100G PAM41.6T DR8则采用单通道200G PAM4而下一代3.2T模块、或者同等速率下更少通道的方案大概率需要单通道400G PAM4来实现。换句话讲单通道400G意味着能用两对光纤干过去需要八对光纤才能干的活激光器数量、调制器数量、驱动芯片数量、光纤布线密度都会同步下降。单通道400G对调制器带宽的要求很直接400G PAM4的符号率大约在106.25 GBd留给调制器有效带宽的余量非常有限。硅光调制器、EML在这个速率上能工作但要么需要特别高的驱动电压要么需要复杂的预加重和均衡来补偿带宽不足结果都是功耗和DSP复杂度上去了。TFLN调制器在这点上几乎是“降维打击”实验室里超100GHz带宽和多GHz线性度是常态所以HyperLight做这个事情在物理层面站得住脚。2. 为什么偏偏是AI互连这个时间点的真实推力2.1 AI训练集群的带宽模型与光互连的供需错配AI训练集群里的GPU几乎每半年换一代算力翻倍的同时卡间通信量也在滚雪球。以大规模Transformer训练为例张量并行、流水线并行、专家并行这些模式会把“集合通信”彻底变成性能瓶颈。网络侧如果不升级GPU闲下来等数据的时间占比就会越来越高单位算力的实际产出反而下降。光互连在这里承担的是大规模跨节点通信的主干道。过去两三代网络从100G升到200G再升到400G主要是靠提升并行通道数比如DR4、DR8这种4通道或8通道并行方案。但并行通道数不能无限上涨因为光纤数量、模块功耗和交换机面板空间都有上限。于是行业形成共识下一阶段必须靠“单通道速率翻倍”来解决问题这恰恰是400G每通道被热捧的根本原因。2.2 功耗、密度与成本三个约束同时收紧如果把AI集群里的光互连抽象成三个约束条件功耗、密度和成本几乎同时逼近红线。400G光模块如果只是把两个200G模块拼起来功耗几乎翻倍网络成本也成倍上涨这在万卡集群里是不可接受的。单通道400G方案可以在速率翻倍的情况下不增加模块数量和功耗系数这是它真正的经济价值。而在交换机侧面板速率的总需求可能要达到51.2T甚至102.4T。如果单通道只有200G那就需要几百条光纤进出一台交换机光纤管理、风扇空间、故障排查都会变成灾难。每通道400G之后端口数量与光纤数量可以显著减少散热和运维压力跟着下降。HyperLight在这个点推400G PIC匹配的正是这种系统级需求而不是单纯秀指标。2.3 光电共封装与超大规模集群的新节奏AI互连的另一个趋势是CPO也就是把光引擎往交换芯片封装里挪缩短电链路、降低功耗。CPO需要紧凑、可灵活扩展的光引擎形态传统可插拔模块那种独立封装不能满足要求。TFLN Chiplet这类平台天然适配CPO场景它体积小、功耗低、可以做成die级单元还能与交换芯片共用先进封装工艺。超大规模集群对光互连的节奏要求也在改变过去一个光模块产品生命周期可能五六年现在AI业务要求一年内完成方案验证到批量部署。拥有标准化chiplet接口、能独立升级调制器能力的平台型方案在这一轮竞争里会比“出一颗用一颗”的传统模式更有生存力。3. 技术点拆解从薄膜材料到PIC成品的几个关键环节3.1 电光调制的基本盘为什么铌酸锂带宽天生占优光模块里的电光调制器本质上是把电信号“写”到光上。硅光调制器靠自由载流子色散效应改变折射率速度相对有上限铌酸锂靠的是线性电光效应普克尔斯效应折射率变化对外加电场响应极快理论上能到几百GHz以上。TFLN继承了这种优势在薄膜波导结构里实现了接近体材料的高电光系数。一个关键参数是半波电压Vπ也就是让光相位改变π所需施加的电压。Vπ越低驱动电路需要的电压摆幅越小功耗越低。TFLN因为光场限制在极小截面中电场与光场重叠度提高Vπ可以做到1V级别甚至更低。这是我看到HyperLight发这类PIC时特别关注的一点在400G PAM4下驱动器功耗是整个模块功耗的很大一部分低Vπ直接等于省电。3.2 从体材料到薄膜TFLN工艺的核心难点TFLN材料本身的优势几十年都没变过真正卡住量产脖子的是把铌酸锂从“晶体块”变成“高质量薄膜”并完成波导刻蚀。铌酸锂是一种非常稳定的晶体化学性质不活泼不容易被常规干法刻蚀刻出陡直光滑的侧壁。早期研究只能靠飞秒激光写波导或质子交换损耗和模式限制都不理想。近几年行业内逐步解决了晶圆键合、离子切片和干法刻蚀三条核心工艺链。简单理解就是先在铌酸锂晶圆里注入离子形成损伤层再把它键合到带氧化硅缓冲层的硅衬底上从损伤层处剥离得到亚微米级TFLN再通过电子束光刻或深紫外光刻与干法刻蚀形成波导。每一步都会影响波导损耗、侧壁粗糙度和片内一致性。HyperLight能做chiplet级PIC说明这些工艺在良率和重复性上已经达到了可工程化水平。3.3 “Chiplet化”对集成度与良率的双重影响芯片制造的基本矛盾是芯片面积越大单片上缺陷导致废片的概率越高。TFLN工艺尽管在成熟但每片晶圆上还是可能分布着局部缺陷。如果把一整颗大PIC作为单一器件哪怕只有一个调制器坏了整颗芯片都报废。一个PIC上放多个TFLN调制器芯粒先单测芯粒再挑选优质颗粒封装能显著改善良率损失。从设计角度看调制器芯粒复用性也很强同一颗TFLN调制器chiplet可以用于DR4、DR8甚至不同代际的模块。换句话讲HyperLight推的不只是调制器芯片而是定义一套“好用的、可拼装的光学子单元”标准。这对模块厂和系统厂来说供应链的灵活性大幅提升不用担心单一方案堵死后续演进路径。3.4 同一颗PIC里到底装了什么一种典型的TFLN Chiplet PIC构成如果拆开看一颗面向每通道400G的TFLN Chiplet PIC通常会包含这几个主要功能区输入端接收来自外部激光器或集成光源的光通过模斑转换器完成光纤到波导的耦合。分光网络把一路输入光分成多路或者给多个调制通道送光常用多模干涉耦合器或级联Y分支。调制区TFLN马赫-曾德尔调制器阵列每个通道一个调制器负责把PAM4信号加载到光上。输出端调制后的光信号耦合回光纤或光波导再传向后续复用/解复用部分。监控与校准结构用来监控光功率、偏置点保证调制器工作在最佳工作点。这其中的无源部分可以用氮化硅或铌酸锂本身实现有源调制区用TFLN chiplet整个PIC的“功能密度”远高于传统分立方案。做成chiplet后每一部分都可以单独测试与筛选组成系统的总良率比单个大芯片高不少。4. 落到系统层面评估这类400G PIC时要看什么4.1 别只看带宽先把链路预算算清楚很多工程师拿到调制器PIC第一反应是看带宽、看插损但真正决定能不能在系统里用的是完整的光功率预算。调制器插损、分光损耗、光纤耦合损耗、后续复用损耗每一项都要加进预算表。每通道400G对光信噪比的要求比100G/200G更高如果插损多了1dBDSP功耗和误码率都会立刻恶化。我建议的做法是先找PIC的完整参数表把每一段的损耗列成表格不要只看“低插损”宣传。最好拿到同一芯片的批量测试数据看损耗分布的均值和方差。单颗样片表现优秀没有意义量产时Cpk过程能力指数够不够才是能否用的关键。4.2 偏置点稳定性和热漂移是被低估的头号工程问题TFLN马赫-曾德尔调制器本质上是一台干涉仪两臂光程差受温度影响会发生慢速漂移。如果没有闭环偏置控制工作点慢慢飘走输出光功率和消光比就会劣化误码率随之升高。HyperLight这类TFLN PIC通常会集成监控光电二极管MPD和偏置控制电路接口但具体实现还要看模块厂商的算法和电路设计。在现场集成时要特别注意热源分布。调制器旁边可能紧挨着DSP或者驱动芯片这些热源的功耗波动会通过基板传到TFLN chiplet导致偏置点快速变化。如果偏置控制响应带宽不够高速场景下就会出现偶发误码块。做系统验证时建议单独做电源切载和温度阶跃测试观察误码率是否有固定节奏的波动。4.3 驱动电压与DSP交互决定实际功耗调制器标称Vπ只是一个静态值实际PAM4驱动需要的是在一定带宽下达到所需调制深度的摆幅。如果Vπ低驱动器的输出摆幅要求就低驱动功耗和发热都同步下降。400G每通道的系统里DSP芯片都在追求更低功耗如果调制器侧能省下几百毫瓦整个800G模块的散热方案就可能降一个等级。不过要注意高带宽下的Vπ会有所劣化厂商给的直流Vπ和射频Vπ往往不同。这里最好实测驱动芯片输出端到调制器输入端的S参数和实际眼图张度特别是对106.25 GBd这种速率连接处的反射和损耗都可能让有效驱动电压明显衰减。灵活的链路匹配设计比如片上终端电阻、封装的低损耗走线很关键但也要防止阻抗失配带来的额外功耗。4.4 从样品到量产可靠性测试必须提前启动先进材料和新型PIC最容易栽在可靠性上。铌酸锂调制器本身有成熟应用基础但薄膜化、刻蚀后的波导侧壁和键合界面会带来新的失效模式。建议在导入早期就做温循试验和带电老化重点关注波导损耗是否漂移、偏置控制是否正常、光纤耦合点是否出现偏移。可靠性测试的周期往往比芯片开发还要长如果等项目快量产再启动发现问题就很难回头修改设计。我见过一些项目因为材料吸湿或热应力导致耦合偏差最后不得不重新改封装。早点拿到可靠性数据哪怕只是初步数据也能帮你避免后续供应链锁定后才发现致命缺陷。5. 常见误区与“我以为”的翻车现场5.1 误区一TFLN成本高得用不起这个印象来自体铌酸锂调制器时代的经验那时候每只调制器都要人工对准光纤成本高、产量低。薄膜化之后工艺流程向半导体制造靠拢晶圆级加工、光刻、自动测试都能复用成熟产线单位成本结构已经发生了根本变化。当然TFLN当下的成本仍然高于硅光但每通道400G速率下传统方案要达到同等性能所需的高线性EML、超高速DSP和复杂散热方案成本也不低。比单器件成本意义不大要比“达到目标链路性能的整模块成本”。在1.6T DR8这类场景里TFLN方案的物料清单有可能比传统方案更简洁整体成本可能更有竞争力。5.2 误区二400G每通道没有标准太超前2024到2025年IEEE 802.3df定义了200G每通道的接口而400G每通道正在进入后续标准讨论框架。一些行业联盟也在推动400G/lane的光接口定义包括调制格式、FEC余量、链路距离目标。虽然没有完全冻结但总方向已经清晰。对于做产品的人来说标准冻结之前切入不算太早关键是方案要有前向兼容性。比如一颗支持400G每通道的PIC也可以降速率当200G用这样一个设计就能覆盖两代产品。HyperLight在时间点上卡得比较准正好是1.6T模块开始起量、3.2T预研启动的阶段。5.3 误区三Chiplet只是封装层面的营销词在电子领域Chiplet是因为先进制程良率问题和设计复用需求才兴起的在光电子领域它的价值类似但表现形式更直接把PIC从“整块定制”变成“标准积木”。这不仅仅是封装技术更是产品定义方式的改变。如果HyperLight的TFLN Chiplet平台能在不同速率、不同通道数产品间复用同一套调制器芯粒那对客户来说意味着交付周期缩短、供应链风险降低、迭代速度加快。这不是宣传话术能覆盖的而是实实在在影响研发节奏的商业逻辑。5.4 翻车现场光模块侧只看速率不看性能窗口很多人拿到400G PIC第一句话是“速率够高吗”却忽略了器件正常工作需要一个性能窗口。比如TFLN调制器的偏置点控制窗口、射频输入功率窗口、温度窗口都有限制。如果不仔细读规格书中关于“推荐工作条件”的部分直接拉到极限在外场测试很容易得出“性能不行”的错误结论。我建议任何新PIC到手先小范围做参数扫描测试把误码率随驱动幅度、偏置电压、温度变化的曲线全部描出来找准中心工作区。这个工作看起来繁琐但对后续调试和故障定位帮助极大尤其是当你需要区分“器件问题”还是“周边链路问题”的时候。6. 做系统集成时我的几条实操建议如果你所在团队正准备评估TFLN Chiplet方案的400G每通道PIC我建议从这几个点入手第一先建一个最小链路验证平台不急着做完整模块。用现成的高速误码仪、驱动器评估板和PIC样品搭一个精简系统测清楚带宽、眼图和误码率随驱动条件的变化。这样做能帮你把“器件能力”和“系统能力”解耦避免在后续模块集成里各环节问题纠缠不清。第二重视光纤耦合封装设计。TFLN波导模场尺寸与单模光纤不匹配时耦合损耗会直接吃掉链路余量。如果厂商提供的是带尾纤的封装形式要重点关注耦合点的长期稳定性确认是否做了抗应力设计。如果是裸die形式那封装工艺的积累就至关重要这部分难度有时比芯片本身还大。第三拿量产统计数据进行决策。这里有一份建议评估参数清单可以作为参考评估维度关键参数关注点带宽电光S21带宽、3dB/6dB点在106.25 GBd下是否留足余量损耗片上插损、耦合损耗、PIC总损耗计算整链路预算电压VπDC、射频Vπ评估驱动器功耗与复杂度线性度无杂散动态范围(SFDR)、三阶截点PAM4信号下线性是否足够稳定性偏置漂移速率、热时间常数判断偏置控制要求可靠性温循、湿热老化、带电老化初测评估长期失效风险更关键的是要看这些参数的批次间波动比如同批芯片插损差0.5dB和差2dB对系统校准和测试良率的影响完全不同。这类数据厂商不一定主动提供但可以要求给几组多片测试数据自己统计分析。第四与DSP选型强绑定。400G每通道的调制器最终要与DSP的均衡能力配合工作。如果DSP的均衡算法很强调制器的一些频响缺陷可以被补偿反过来如果DSP功耗预算有限就需要调制器本身更“干净”。所以不要单独评估PIC要把“调制器PICDSP驱动器”作为整体做功耗和性能权衡。最后说到后续扩展这套TFLN Chiplet平台最合理的演进路径是把激光器也芯粒化做成完整的光引擎chiplet进一步降低封装复杂度。当调制器、激光器、探测器都能以标准芯粒形式组合时光模块厂商的研发模式会从“定制PIC流片”转向“选型组合”整个供应链速度都会上一个台阶。到那时AI集群的光互连可能真的不再是瓶颈而是一块快速迭代的乐高积木。我个人实操中的体会是先进光器件导入的最大障碍往往不是技术指标本身而是团队是否愿意用新思维重做链路预算和工艺验证。TFLN Chiplet这条路能走多远最终取决于整个产业链能不能把这个平台思维落地成稳定的供应体系而不只是靠一两颗样片证明可行性。