DeepVerse 系列

云端大算力推理芯片

DeepVerse 100P

针对百万长上下文Prefill性能优化 Prefill Pool(P芯片)

DeepVerse 100D

针对300tokens/s的Decode吞吐优化 Decode Pool(D芯片,类Rubin)

DeepVerse 100L

实现极致低时延推理(1000 tokens/s) Decode Pool(L芯片,类LPX)

PRODUCT FORM

产品形态

DV100P超节点

DV100P超节点

为百万级长上下文Prefill而生

最大支持 256卡Scale-Up,构建统一可扩展的PrefillPool,融合高密算力、大容量内存与高带宽互联。面向超长Prompt、RAG、多轮 Agent等场景优化,显著提升长上下文推理效率,降低部署成本,支撑大规模高并发AI应用。

  • Prefill做成超节点Prefill做成超节点
  • 面向百万长上下文面向百万长上下文
  • 为万亿级MoE而准备为万亿级MoE而准备
  • 开放异构扩展能力开放异构扩展能力
DV100D超节点

DV100D超节点

面向高吞吐Decode的推理引擎

DV100L超节点

DV100L超节点

为百万级长上下文Prefill而生

这不只是更大的集群,而是一套面向百亿Token一分钱长期愿景的推理工厂

P超节点、D超节点与L超节点协同构建万卡级分离式推理架构,实现Prefill、Decode Attention与Decode FFN 异构部署,并结合AI原生KV Cache机制,减少重复计算,提升推理效率与资源利用率。

0755 2360 7360