首 页 资讯 产业动态 发明·创新 探索·发现 科技人物 专家讲坛 院士知播

首页>科技>产业动态

深耕TPU生态:中昊芯英以自主算力赋能新质生产力

2026年08月06日 16:58  |  作者:李元丽  |  来源:人民政协网 分享到: 

人民政协网(记者 李元丽)2026年世界人工智能大会期间,华东地区(杭州)首座国产TPU千卡智算集群正式落成。这是中国电信体系内首个大规模国产TPU集群部署项目,也是华东地区的首个国产TPU千卡级算力集群。项目一期共采用1024片“刹那®”TPU AI 专用算力芯片,算力规模达400P;项目二期扩容工程将采用新一代 TPU AI 芯片“须臾®”,总算力规模规划突破10000P。从单颗自研芯片的技术突围,到千卡级智算集群的规模化落地,从单点核心技术攻坚,到全栈产业生态协同打通,中昊芯英完成了国产TPU从“可用”到“规模化商用”的关键跨越。

行业变局:算力竞争进入“拼系统”时代

当下中国AI算力市场正经历深刻变革。截至2026年3月底,我国智能算力规模已达188万P。在7月20日召开的国务院常务会议上,进一步部署了包括算力网、新型电网、新一代通信网等在内的“六张网”规划建设,凸显了算力作为与水、电并列的国家战略性资源的地位。

政策层面同样释放了清晰的信号。2026年政府工作报告首次提出“实施超大规模智算集群、算电协同等新基建工程,加强全国一体化算力监测调度,支持公共云发展”。在这一大背景下,算力产业的竞争逻辑正在发生转变:国产算力已从“解决有无”跨越到“追求高效、低成本商业化Token产出”的新阶段。芯片厂商不再热衷展示单卡算力,转而聚焦算力底座搭建、整机集群部署、软件全栈适配与行业生态一体化交付。正如业内人士所言,算力已进入“拼系统”时代。

技术突围:从“刹那®”到“须臾®”的跨越

中昊芯英是国内最早投身TPU架构AI专用算力芯片研发的企业之一。2023年,中昊芯英成功流片并量产国内首枚高性能TPU芯片“刹那®”,填补了国内自研专用AI算力芯片领域的空白。该芯片拥有完全自主可控的IP核、全自研指令集与计算平台,AI算力性能超越海外知名GPU产品近1.5倍,能耗降低30%。

三年后的2026年6月30日,中昊芯英正式发布新一代全自研高性能TPU AI芯片“须臾®”。“须臾®”单芯片混合精度浮点算力达896 TFLOPS,8-bit推理算力达1792 TOPS,性能是上一代“刹那®”的3倍。单芯片额定功耗600W,相较于算力性能持平的传统芯片,功耗降低50%。

性能跃升的背后,整套芯片贯彻“软件驱动硬件架构”的顶层设计思路。三重软硬件协同创新叠加,让“须臾®”实现三倍综合性能提升,同时芯片整体功耗未出现明显上涨。第一重为计算流水线架构全面优化:依托初代芯片规模化落地经验,针对业务场景中暴露的算力低效痛点,重构矩阵计算核心单元、线性层激活函数模块、低精度高效计算单元,大幅提升基础算子硬件执行效率,从计算底层释放算力;第二重是先进芯粒封装技术创新:采用双芯粒同基板封装方案,单块基板集成两颗独立高性能计算芯粒,配套自研低延迟专属片间互联通道,两颗芯粒协同并行运算,直接释放双倍计算算力;第三重属于片上存储架构扩容迭代:拓展片上高速存储容量与读写带宽,减少模型运算过程中频繁跨芯片读写数据带来的算力损耗,有效降低数据交互延迟。

生态构建:从芯片设计到全链条能力

中昊芯英不仅是芯片设计者,更是国产TPU产业生态的先行者。公司具备从芯片设计、电路开发、编译工具到模型适配的全链条能力。核心技术已完整覆盖芯片IP核、专属指令集、底层算子加速库、整机系统软件的自主研发,无海外核心技术依赖。

在软件生态层面,泰则® 2.0兼容PyTorch、vLLM、SGLang等主流AI框架,适配DeepSpeed、Megatron-LM等分布式训练套件,已完成Qwen全系列、DeepSeek、GLM、MiniMax等数十款大模型的深度适配,可快速高效完成新模型和迭代模型的适配与部署。

在生态合作方面,中昊芯英TPU算力已正式接入OpenCSG CSGHub开源AI基础设施平台,进一步丰富国产AI算力生态。双方技术团队完成了中昊芯英TPU芯片与CSGHub平台的全流程联合适配测试,涵盖模型上传与部署、单机与多卡推理、大模型微调、算子调度、稳定性连续负载及量化加速等核心场景。测试结果表明,中昊芯英TPU算力芯片可原生兼容、稳定流畅运行OpenCSG开源平台全部核心功能,软硬件协同性能达标,满足商用部署及开源生态接入需求。

基于此,CSGHub平台即将上线中昊芯英TPU算力租赁规格,提供从单卡128GB至八卡1024GB共八档配置。中昊芯英TPU算力将成为CSGHub平台上可供开发者和企业用户按需调用的一种标准算力资源,用户无需在底层硬件适配和集群管理上额外投入精力,通过平台即可直接选择和调度中昊芯英TPU算力,完成从模型开发、微调训练到推理部署的全流程工作。

商业化落地:从规模交付到千卡集群

中昊芯英的初代“刹那®”芯片已在多个行业实现大规模客户交付与成熟落地。目前,公司产品已成功部署于由深圳联通、天津移动、太极股份、江西上饶等运营商、政府机构及科技企业建设的多个超大规模智算中心,并已在高校、科研机构等的科研计算平台与教学实验环境中投入使用,辐射至金融、传媒、教育、医疗等广泛行业领域。

本届世界人工智能大会期间,中昊芯英联合杭州电信、中兴通讯正式宣布华东首个国产TPU千卡智算集群在杭州落成。项目采用分工协同模式:中昊芯英提供底层TPU芯片、服务器整机与配套软件栈;中兴通讯负责整机集成、高速互联组网与集群系统调优;杭州电信承担机房部署、算力运营与政企客户算力服务输出。

业内人士指出,大模型时代的算力竞争,是架构、生态、成本与供应链安全的综合比拼。以TPU为代表的国产专用算力路线,能够与通用GPU形成互补,丰富我国算力供给结构。从技术突破到产业落地,从单点产品到生态体系,中昊芯英正以TPU专用算力为支点,助力国产算力产业赋能实体经济与新质生产力发展。未来,中昊芯英将持续发挥国产TPU龙头示范作用,推动本土算力软硬件生态协同成熟,以自主可控算力底座赋能各行各业数字化转型,持续为国内新质生产力发展注入底层算力支撑。

编辑:隋天仪