
GPNPU 智算架构:融合通用编程与专用效率
面向大模型推理时代
打造的新一代 AI 智算处理器

PRODUCT FORM
多元异构计算融合·构建智能算力新生态
统一线程执行,真正承接主流开发生态
以 SIMT 通用线程模型和 CUDA 兼容软件栈为基础,支持复杂控制流、动态调度与完整推理流程承载
通用架构,也能实现 NPU 级效率
通过 SIMD 张量融合计算、混合精度执行与片上显存协同,提升有效算力,吞吐表现与单位功耗产出
面向实时智能的响应式架构
依托近核热数据驻留、低跳数互连与解码优先调度,显著改善首响应、首Token与尾时延表现
以 3D MEMORY 重构数据供给能力
通过 3D 堆叠存储与分层带宽微细化体系,突破传统平面存储限制,支撑长上下文与MoE场景的数据访问需求
从单芯片走向超节点推理平台
通过统一内存语义的高速互连与系统级扩展架构,支撑从单卡、整机柜到超节点的持续扩展
Technology Architecture Introduction

