2026年7月19日,世界人工智能大会(WAIC)进入第三天,天数智芯正式发布新一代通用GPU旗舰产品——天垓300。
这是天数智芯新一代自研架构的首款产品。在发布会现场,天数智芯AI与加速计算负责人单天逸提出了一个判断:人工智能正从理解与生成信息的"信息智能",迈向具备规划和执行能力的"行动智能",并进一步拓展至能够建模、预测和探索未知的"探索智能"。三类智能对计算提出不同要求,也构成了天垓300的产品设计主线。
信息智能:把Attention和MoE的效率"压榨"到极致
大模型参数规模持续膨胀,上下文长度不断拉长,推理请求量级攀升。算力平台面临的挑战不再是"能不能跑",而是"跑得多快、花多少钱"。
天垓300基于SIMT通用计算架构,可高效支持标量、矢量和张量等多种计算类型。针对大模型计算的两大核心环节——Attention与MoE,产品做了深度优化。
在Attention计算中,天垓300通过提升矩阵计算与向量计算的并行效率,减少数据读写等待和冗余计算,在不同精度下实现超过90%的Attention效率。在上下文64k的长序列场景中,其Attention效能高于Hopper架构主流方案10%。
MoE(混合专家)架构近年来越来越多地出现在前沿大模型中,但专家调度和数据路由损耗一直是效率瓶颈。天垓300通过算法与硬件协同优化,在DeepSeek V4 MoE场景中的计算效率突破70%,综合训练效能和性价比优于Hopper方案。在推理场景中,可在保持相同响应体验的情况下承载更多并发请求,平均效能高于Hopper方案10%。
行动智能:让Agent"想得快"也"做得快"
Agent类应用正在从概念走向现实——智能编程、办公助手、业务自动化……它们不仅要理解目标和规划任务,还要持续调用工具并完成执行。这对首字响应、生成速度和多卡通信提出了更高要求。
天垓300强化了PD分离能力,分别针对上下文处理的Prefill阶段和逐Token生成的Decode阶段进行差异化优化。
实测数据显示,在Qwen、GLM、Kimi、DeepSeek等主流模型测试中,天垓300首字延迟较Hopper架构主流方案降低约20%。针对Decode阶段高频、多卡、小数据量通信的痛点,产品通过降低协议开销、优化链路路径和数据流转机制,使平均通信延迟降低约13%。在GLM 5.2等模型的Decode测试中,效能较Hopper方案提升10%。
探索智能:回归计算本质,不只为Transformer而生
如果说信息智能和行动智能解决的是当下AI的算力需求,那么探索智能面向的是未来。
在新材料发现、气象预测、数字孪生和世界模型等场景中,AI需要参与复杂系统建模、实验验证和未来预测。计算范式也由相对集中的大模型负载,拓展至矩阵求解、动态规划、稀疏计算和仿真模拟等多类任务。
天垓300坚持"回归计算本质",不局限于Transformer架构。它可高效支持标量、矢量和张量计算,覆盖FP4、FP8等多种精度及MMA、DPX、FMA等指令。除Attention、FFN和MoE外,还可适配矩阵求解、动态规划、稀疏计算和数字孪生等任务。在Cosmos3世界模型中,天垓300的推理效能相较Hopper方案同样高出10%。
不止于芯片:底层创新与全栈生态
支撑三类智能的,是天垓300在底层架构上的持续创新。
ixSMEX通过提高数据复用率减少重复访存;ixDPX将动态规划中原本需要六条指令完成的计算压缩至一条;ixTrans则通过无损矩阵转置,降低存储冲突和显存开销,进一步释放芯片计算效能。
天数智芯认为,通用GPU的长期价值不仅来自单颗芯片的性能,更在于构建一个通用、好用、易用的生态。公司自2018年起持续完善软件栈,目前已开发近百个加速库,并形成覆盖通信、编译、驱动、量化和性能分析的工具体系。天垓300同步支持全球主流大模型框架、模型及关键加速组件。
芯片之上:天数超节点构建规模化算力新选择
单颗芯片的性能再强,最终要放到系统中去检验。天数智芯在推出天垓300的同时,同步打造了面向大模型训练与高并发推理场景的天数超节点解决方案。
该超节点以国产通用GPU为核心,实现144芯高速全互联,通过高带宽互联、统一资源调度和软硬件协同优化,提供稳定、可靠、可扩展的高质量算力。目前,天数超节点已获得多家潜在客户关注,并进入方案交流与合作推进阶段,为国产智能算力基础设施建设提供了全新选择。
天垓300已具备规模化应用条件,并与国内云厂商、服务器厂商、互联生态及超节点系统开展深度适配,可支持从单机到规模化集群的部署。
从芯片到场景:WAIC上的完整答卷
本届WAIC,天数智芯携天垓、智铠、彤央三大通用GPU产品系列参展,集中展示了在互联网、金融、工业、交通、气象、能源、医疗、电力、政务及Token出海等领域的应用实践。
围绕训练、推理和边端计算等需求,天数智芯已形成完整的产品布局。旗舰产品线天垓系列面向大模型训练、微调及大规模集群应用;智铠系列专为云端及边缘推理应用设计;今年1月发布的彤央系列聚焦边端算力,覆盖100tops至300tops稠密算力。三条产品线分别面向不同业务重点,同时沿用通用GPU技术路线和软件体系。
截至2025年底,天数智芯已服务30余个行业的340余家客户,集群稳定运行超过1000天,在线运行规模过万卡。
对天数智芯而言,天垓300的发布不止是一款新产品的亮相,更是公司发展逻辑的一次集中验证。从产业价值看,天垓300在Attention、MoE、PD分离等真实业务负载中全面对标并超越国际主流方案,证明了国产GPU不再是"备胎"式的被动选择,而是具备主动替代价值的算力选项。而天数超节点的推出,则进一步将芯片能力转化为系统级的算力输出——以144芯全互联为核心,为国产智能算力基础设施建设提供了从芯片到系统的完整解决方案。
天垓300是一颗芯片,但绝不止于一颗芯片。它是天数智芯过去多年持续投入研发、深耕行业、打磨生态的一份答卷。当AI算力的竞争从单纯的峰值数字走向单位算力性价比、从单一训练走向全场景覆盖,天数智芯正以天垓300为新的起点,走出一条属于自己的通用GPU赶超之路。