中新网上海新闻8月13日电(徐银)当前,大模型与智能体应用持续迭代成熟,行业解决方案不断丰富,正加速从技术探索迈向规模化产业落地阶段;AI 算力底层格局也迎来深刻转型,逐步摆脱单一GPU主导模式,向着TPU、NPU、DCU、ASIC等多元算力形态协同发展的方向演进。国内芯片企业立足自身技术禀赋,走出差异化架构路线展开布局。
摩尔线程、沐曦、壁仞等企业持续深耕通用GPU赛道,围绕图形渲染与通用AI计算需求搭建自主软硬件栈,兼顾生态兼容与算力性能,面向智算中心、数字孪生、专业可视化等多元场景推进产品商业化落地,持续完善国产通用算力供给体系。 华为、寒武纪、昆仑芯等厂商深耕ASIC专用算力芯片方向,针对AI矩阵运算特性做架构深度优化,依托自研计算架构与配套开发框架,分别打造覆盖云边端的全栈算力方案、云端训推一体化芯片产品以及适配深度学习框架的加速平台,在大型智算集群、高并发推理场景实现规模化部署。
TPU针对张量计算和AI负载深度优化,通过重塑计算单元维度与数据传输路径,在AI场景中能效比和计算密度显著优于传统通用架构,是降低算力成本、提速模型迭代的关键路径,也是国产AI算力生态中极具战略价值的方向。中昊芯英长期专注于高性能TPU AI芯片、计算集群与算力平台的设计研发,是国内最早实现全自研高性能TPU芯片流片与量产的企业。2023年,其成功流片了国内首枚高性能TPU AI专用算力芯片“刹那®”并实现量产和产业化。伴随行业需求持续升级,市场对全栈自主、可支撑超大规模集群部署的一体化TPU解决方案需求持续提升,中昊芯英依托多年原生TPU架构研发积累,推出新一代全自研 TPU 芯片“须臾®”与迭代升级的泰则®2.0智算平台,为国产专用算力迭代提供新的实践样本。
如果说初代TPU芯片“刹那®”完成了中昊芯英在国产专用算力赛道的技术破冰与市场落地,全新二代“须臾®”则依托三年商业化实战完成全方位架构升级。针对行业普遍的存储墙瓶颈,“须臾®”重构脉动阵列数据流调度,泰则®2.0智算平台是“须臾®”落地产业的核心载体。平台已深度适配Qwen、DeepSeek等数十款国产大模型,配套一体化可视化运维系统。技术之外,中昊芯英同步推进产学研协同与产业生态共建。在携手落地的华东地区首个国产TPU千卡智算集群项目中,中昊芯英作为项目核心算力供给方,为集群提供自研 TPU AI 专用算力芯片硬件支撑。
长期来看,TPU专用架构天生适配大模型矩阵运算,在规模化推理场景拥有更优单位Token成本与能效比,随着Prefill-Decode分离推理成为行业主流,差异化竞争优势会持续凸显。企业凭借全自研技术、成熟落地案例与开放生态,持续夯实国产专用算力底座,为各行各业AI国产化转型、新质生产力发展提供自主可控的底层算力支撑。(完)
注:请在转载文章内容时务必注明出处!
编辑:李秋莹






