启望 S2大模型推理 GPU

产品概况

面向 AI 大模型时代的高能效推理引擎

启望 S2 是基于先进制程打造,面向 AI 大模型时代的高能效 GPGPU ,覆盖高并发推理、模型微调等核心负载,并能通过异构多核架构设计与全栈软件生态优化,提供强大的推理算力,实现能效比显著提升。启望 S2 具备高度兼容性和开放性,可无缝迁移现有 GPU 工作负载,是企业加速 AI 转型与国产化替代进程的理想引擎。

启望 S2 芯片连接多种计算负载的算力平台
  • 高并发推理
  • 模型微调
  • 无缝迁移

高并发 · 高效能 · 高兼容

GPGPU 架构赋能高性能计算

启望 S2 以 GPGPU 架构与全栈软件生态优化,覆盖高并发、长上下文等核心推理负载,尤擅为大模型推理提供高效能算力。启望 S2 性能位居国内一线之一,已实现规模化量产,可为大模型推理提供稳定算力支撑。

灵活扩展与集群部署

启望 S2 支持 PCIe 卡与 OAM 两种形态,并可从多卡单服务器扩展至大规模智算集群,并通过 SRLink 等高速互联技术,实现多卡多节点间的高效数据传输与协同扩展,满足多样化 AI 推理部署需求。

主流生态高度兼容

依托自研 TANG 编程模型及 SIRE 软件栈,启望 S2 与主流 AI 开发生态及深度学习框架高度兼容,已适配 PyTorch、vLLM、SGLang 等主流框架与推理引擎,可帮助客户实现无缝迁移与部署。

产品形态

启望 S2 提供灵活的模块化形态,满足不同计算环境与部署需求

智望 S2-X1 PCIe 计算卡

Sun S2-X1 PCIe Accelerator Card

智望 S2-X1 PCIe 计算卡

  • 高性能、即插即用的通用推理单元,兼容主流服务器平台
  • 采用自研高速互联技术,支持多卡协同与高效扩展
  • 可从单节点部署延展至 AI 集群级推理算力
  • 适用于边缘、本地机房与智算中心的规模化 AI 推理部署

辰望系列| 高性能、可扩展的智算平台

SIRE

自研 SIRE 软件栈

精准把控从固件、驱动、运行时到编译器的全部细节,围绕业务持续演进、深度定制、极致调优。

  • 与主流第三方 GPGPU 计算软件平台生态高度兼容,支持现有应用的无缝迁移
  • 针对大模型场景深度优化,大幅提升推理效率
  • 开发者可快速上手,构建高效稳定的 AI 应用

悬浮探索每一层

Sunrise Integrated Running EnvironmentSIRE
  • SoC 固件层
  • 驱动与运行时层
  • 编译器与算子库层
  • 框架层与生态应用

进一步咨询

深入了解曦望Sunrise 全系列产品及服务