GPGPU 架构赋能高性能计算
启望 S2 以 GPGPU 架构与全栈软件生态优化,覆盖高并发、长上下文等核心推理负载,尤擅为大模型推理提供高效能算力。启望 S2 性能位居国内一线之一,已实现规模化量产,可为大模型推理提供稳定算力支撑。
产品概况
启望 S2 是基于先进制程打造,面向 AI 大模型时代的高能效 GPGPU ,覆盖高并发推理、模型微调等核心负载,并能通过异构多核架构设计与全栈软件生态优化,提供强大的推理算力,实现能效比显著提升。启望 S2 具备高度兼容性和开放性,可无缝迁移现有 GPU 工作负载,是企业加速 AI 转型与国产化替代进程的理想引擎。

启望 S2 以 GPGPU 架构与全栈软件生态优化,覆盖高并发、长上下文等核心推理负载,尤擅为大模型推理提供高效能算力。启望 S2 性能位居国内一线之一,已实现规模化量产,可为大模型推理提供稳定算力支撑。
启望 S2 支持 PCIe 卡与 OAM 两种形态,并可从多卡单服务器扩展至大规模智算集群,并通过 SRLink 等高速互联技术,实现多卡多节点间的高效数据传输与协同扩展,满足多样化 AI 推理部署需求。
依托自研 TANG 编程模型及 SIRE 软件栈,启望 S2 与主流 AI 开发生态及深度学习框架高度兼容,已适配 PyTorch、vLLM、SGLang 等主流框架与推理引擎,可帮助客户实现无缝迁移与部署。
产品形态

Sun S2-X1 PCIe Accelerator Card

2U 空间可部署千亿参数大模型算力平台,预装 AIOS 系统,可实现主流模型开箱即用。

从计算到加速的全链路国产四卡一体机,软硬深度集成与主流模型兼容,实现高效易用的部署运维。

4U 空间内集成 8 卡高密度算力,满足多类组网与存储访问需求,并集成主流高性能推理引擎,深度适配主流 AI 应用。

为千亿参数级大模型推理任务优化,提供开箱即用的集群算力单元,以先进冷却系统确保高密度计算单元持续稳定运行。

单机运行满血版 Deepseek 的国产算力平台,存算联密度领先;为 MoE 大模型独创计算感知通信拓扑,效能较通用计算平台提升 400%。
SIRE
精准把控从固件、驱动、运行时到编译器的全部细节,围绕业务持续演进、深度定制、极致调优。
悬浮探索每一层