2026世界人工智能大会(WAIC)期间,中昊芯英、杭州电信、中兴通讯联合宣布华东地区(杭州)首个、也是中国电信体系内首个大规模部署国产TPU千卡智算集群项目正式落地。

华东地区(杭州)首个国产TPU智算千卡集群落成仪式
这个里程碑式的项目以构建的“自主芯片+全栈集成+智能运营”的新一代智算体系,为华东数字经济高质量发展筑牢自主算力底座,树立了国内国产TPU规模化智算基础设施建设新标杆,标志着国产芯片企业、通信龙头与运营商三方生态协同的突破性成果。
作为国产TPU AI专用算力芯片的先行者,中昊芯英以两代TPU产品提供核心算力底座支撑;杭州电信作为建设主体,依托其领先的算网融合能力与算力运营体系,搭建了一体化运营平台,实现从基础算力资源输出者向“智算综合服务+生态协同枢纽”的复合角色跃迁。
性能倍迁:从“刹那®”到“须臾®”的架构革新
据了解,项目一期集群采用1024片中昊芯英“刹那®”TPU芯片,算力规模达400P。

国内首枚量产的高性能TPU架构AI专用算力芯片刹那®
“刹那®”是中国首枚量产的高性能TPU架构AI专用算力芯片,其AI算力性能超越海外同期著名GPU产品近1.5倍,能耗降低30%,单位算力成本降低近一半。而新一代“须臾®”芯片则实现了又一次架构革新,其混合精度浮点算力达896 TFLOPS,模型运行性能是“刹那®”的3倍,8-bit推理算力达1792 TOPS,相较于算力性能持平的传统算力芯片功耗降低50%;采用“须臾®”芯片的项目二期测试结果显示已基本满足要求,将为产业客户提供更强性能、更低能耗的国产TPU算力支撑。

中昊芯英联合创始人&CTO郑瀚寻
中昊芯英联合创始人、CTO郑瀚寻指出,二代芯片的性能飞跃源于“软件驱动硬件架构”的顶层设计思路。通过计算流水线架构全面优化、采用双芯粒同基板封装的先进封装技术,以及片上存储架构的扩容迭代,三重核心创新叠加,共同实现了三倍的综合性能提升。在集群层面,TPU架构天生适配大规模集群,其原生设计的3D Torus拓扑结构,专门针对上百颗芯片同步并行运算、高密度并发通信场景设计,在大规模集群环境下通信延迟更低、整体运算性价比更高,这是其区别于通用GPU集群的核心差异化优势。
目前,该集群已支撑视觉计算、人机交互、生命科学、智慧教育等十余个行业场景的AI创新需求。
存储革新:从芯片到集群的全栈优化
杭州电信智算中心项目在存储方面也取得了改进与突破。
在芯片层面,新一代“须臾®”TPU芯片通过架构重构,显著拓展了片上高速存储的容量与读写带宽,有效减少了模型运算中频繁跨芯片读取数据带来的延迟与算力损耗。
在系统解决方案层面,中昊芯英通过创新的整机架构设计,采用PCIe Switch硬件架构打通CPU与全部TPU的IO带宽,在不增加昂贵配套内存硬件的前提下,充分释放现有内存的带宽利用率,从系统层面降低了客户的单位算力存储成本。
生态共建:从单一项目放眼全域协同
三方此次合作的基础,是共同应对当前AI产业规模化落地所面临的算力短缺与成本高昂的挑战。

杭州电信智算及IDC中心总经理王良
杭州电信智算及IDC中心总经理王良表示,TPU擅长张量运算,在推理能力方面优势尽显。Token经济兴起后,社会对Token的需求量巨大,TPU千卡集群经过深度调优,Token输出效率提升超十倍,百万Token调用成本从百元降至十元以内。
在WAIC会议期间,中昊芯英携手生态伙伴完成了新一代国产TPU商用启航与国产TPU算力全域生态合作两大重磅签约,标志着合作从单一项目走向了更广阔的生态共建。前者是联合杭州电信、深圳联通、OpenCSG等伙伴,推动国产TPU在通信、金融、互联网等关键领域的规模化商用。后者则与联想、中兴通讯、成都工业人工智能创新研究院等达成全域深度生态合作,合作版图覆盖算力基础设施搭建、底层软件适配优化、行业定制方案研发等全链路环节。
这一系列举措清晰地勾勒出中昊芯英的生态战略:以自研TPU芯片为基石,联合运营商、设备商、科研院所及上下游科技企业,聚力打通产业协作壁垒,搭建自底层芯片至上层行业应用的完整国产化算力闭环,为国产算力体系实现自主可控、规模化高质量发展持续赋能。
厚积薄发:崛起于三维创新之路
在笔者看来,中昊芯英生态战略的底气,源于其在人才、技术、市场三个维度的深厚积累与持续创新。
创始团队拥有谷歌TPU原厂研发经验,自2018年创业之初便锚定TPU技术路线,致力于从底层解决大模型长期算力成本痛点。
在技术层面,公司坚持“软件驱动硬件架构”的思路,通过计算单元利用率、内存管理及通算融合三个维度的创新与优化,满足Agent时代超线性增长的算力需求挑战。例如,其TPU底层架构原生适配PD分离调度,落地门槛更低、调度效率更高,有效应对了以“小龙虾”类智能体爆发为代表的Token经济新需求。
在市场层面,中昊芯英采取分阶段分层推进策略。第一阶段主攻国企、央企、公有云厂商,依托国产化采购需求完成商业化闭环;第二阶段深化政企合作,启动头部算法公司适配;第三阶段则目标与头部互联网大厂达成合作,完整覆盖大模型训练、线上推理全场景。目前,公司已落地多家金融、政务行业政企客户,并完成了对Qwen、DeepSeek、GLM等数十款国内主流大语言、多模态模型的深度适配。

中昊芯英创始人& CEO 杨龚轶凡
从2018年启动研发,到2023年第一代“刹那®”芯片落地,再到2026年发布性能提升三倍的“须臾®”芯片,国产自研TPU芯片正稳步迈向从“可用”到“好用”的阶段。创始人、CEO杨龚轶凡表示,公司长期产业目标是推动TPU成为AI算力领域的通用主流架构,对标x86处理器在通用计算领域的地位,构建国内自主可控的TPU完整算力生态,持续降低全行业算力使用成本,加速万亿级AI产业落地普及。
绿色与信创:构筑自主可控的算力底座
在节能降耗和绿色计算方面,该项目同样走在前列。杭州电信智算及IDC中心总经理王良介绍,其最新数据中心的PUE已基本实现1.2,若大规模应用液冷服务器,更有望进一步降低至1.1左右。“液冷技术不仅能大幅降低能耗,还能提升芯片主频和算力效率”。他期待与中昊芯英的合作能进一步推动液冷技术在算力服务器建设上的大规模应用,实现双赢。
在信创领域,该项目实现了从AI芯片、服务器硬件、集群组网到算力调度平台的全链路国产化。杨龚轶凡强调,从芯片硬件底层到上层服务API,“须臾®”芯片的国产化自研程度处于国内第一梯队。芯片核心逻辑层100%全自研,整套芯片专属指令集、全部底层IP均为独立设计研发,完整实现了芯片底层到上层业务服务全链路自主可控,满足政企全场景国产化采购的硬性要求。
未来展望:挑战与担当并存
超节点集群的成熟落地仍面临多重挑战,其核心难点包括集群通信瓶颈、多租户数据隔离与隐私防护、高密度集群的散热方案迭代,以及软硬件协同成熟度不足等。当前国内所有厂商仅完成超节点基础硬件雏形,分布式调度软件、集群运维系统等距离标准化、稳定商用,还有很长的路。
尽管挑战重重,但中昊芯英对TPU技术路线的未来充满信心。杨龚轶凡认为,随着大模型商业化全面铺开,行业已逐步意识到通用GPU无法承载海量Token推理的算力需求,TPU成为除GPU外全球唯一实现大规模量产、市场认可的成熟算力架构。他表示,中昊芯英的志向不仅是成为一家领先的芯片公司,更希望将TPU打造成AI界的x86,通过持续的技术迭代与生态共建,让自主可控的国产TPU AI算力更直接、更高效地服务于千行百业,为华东乃至全国的产业高质量发展注入源源不断的算力源泉。