中国领先的 AI 推理 GPU 及全栈解决方案提供商

曦望Sunrise以全栈自研推理 GPU 为中国 AI 发展铸算力底座

不拼参数,拼单位经济性

让 AI 推理算力如水电般普惠可得

BUILT FOR INFERENCE.

当推理成为主线,算力需要重新定义

大模型与智能体推理 GPU

启望 S3为 Agent 时代量身打造

国内首款挂载 LPDDR6 的 GPU,国内首用 PCIe Gen6 的 GPU。突破技术路线、架构和 IP 局限,显著提升算力、显存和能效,

  1. 目标将推理性价比在当前主流基础上实现数量级跃迁。

了解启望 S3
5X单芯片性能提升
100% Host-Device 互连带宽提升
98-99%关键算子计算效率
90%单 Token 成本降低

INFERENCE INFRASTRUCTURE

不止是 GPU还是全栈推理基础设施

覆盖云边端全场景需求,提供软硬一体定制化算力与服务,支撑不同规模客户的多元场景落地

  • 云服务
  • 行业场景
  • 新兴产业

构建 AI 推理开发与部署环境,提供从编程接口到底层运行时的完整工具链,并面向大模型推理的落地需求,将硬件算力转化为可直接调用的模型服务能力

  • 基础工具链
  • 编程接口
  • 基础库
  • 基础平台
  • 模型引擎
  • MaaS 服务能力
  • IP 模块化

具备无缝从单芯片到大规模集群的可扩展性和灵活性,精准匹配不断演进的推理需求

  • 启望系列 GPU
  • 智望系列计算卡
  • 辰望系列服务器
  • 寰望系列智算集群
  • 熙望系列工作站

Solutions

以推理最优解攻克多元场景下的算力难题

ADVANTAGES

专注推理,深耕 AI构筑曦望核心竞争力

更懂 AI,聚焦推理

All-in 推理

前瞻领先的 AI 趋势判断,聚焦推理赛道与 GPGPU 架构,成就首家 All-in 推理的国产 GPU 独角兽、首批实现推理 GPU 规模化量产交付的芯片公司之一;核心产品 S3 为 Agent 时代量身打造,释放 AGI 商业化潜能。

卓越经济性, 单位 Token 成本优化

极致性价比

软硬协同一体,模型统一调用,最大化提升 Token 生成效率,全链路实现最优经济性;趋近于零的迁移成本、全液冷方案、开箱即用,一站式解决客户算力落地痛点;核心产品启望 S3 针对大模型推理作极致优化,实现单位 Token 推理成本较上一代产品下降 90%,目标推动 AI 推理算力的普惠化落地。

芯片基因,AI 洞察

顶尖团队

近 400 人研发团队,约占员工总数的 80%,核心技术骨干平均拥有 15 年行业经验,兼具芯片研发能力与 AI 场景理解,覆盖架构设计、芯片研发与软硬协同优化等关键环节,以工程化能力推动产品持续迭代。

创新突破,专利护航

全栈自研

全栈自研指令集、GPGPU IP 及编译工具链和集群调度系统,拥有 100+项核心专利,百人团队实现“一次流片成功”,极致工程化能力业内罕见;具备 Gartner、IDC 等顶尖机构背书,硬核实力获权威认证。

公司动态

News

每一步技术深耕见证曦望推理进程

查看全部新闻

进一步咨询

深入了解曦望Sunrise 全系列产品及服务