杭州GPU独角兽曦望再获20亿元投资,投后估值约200亿

南都N视频APP · 政商数据
原创2026-08-31 18:29

近日,南都记者获悉,国内全栈自研AI推理GPU企业曦望(Sunrise)再获新一轮20亿元融资,投后估值达到约200亿元。本轮战略融资由同创伟业、中科创星、人保资本、同程旅行、正大集团、Janchor Partners建峖、建信股权、九安医疗、盈峰环境等联合投资。

图片

公开资料介绍,曦望是国产全栈自研人工智能算力芯片企业,前身是商汤大芯片部门,2024年底分拆独立运营,专注于高性能GPU及多模态场景推理芯片的研发与商业化。此前,在4月20日,曦望刚完成一轮超10亿元的融资,由多家产业方战投、地方国资及头部财务机构共同参与,成为彼时国内GPU赛道诞生的最大单笔融资之一。

从技术路径来看,据介绍,不同于行业主流的“训推一体”路线,曦望从成立第一天起就坚定All-in推理赛道,以用户真实的Token成本、单位能耗和服务稳定性为芯片设计核心。目前,曦望已推进三代推理GPU迭代、数万颗GPU量产落地,实现了从芯片研发、产品量产到解决方案交付的完整闭环。

据介绍,2026年1月,曦望正式发布新一代旗舰产品启望S3推理GPU,作为国内首款搭载LPDDR6且兼容LPDDR5X内存的推理GPU,在显存选择上,S3没有沿用训推一体GPU标配的高带宽内存(HBM),而是选择了手机、笔记本电脑常用的低功耗内存(LPDDR)。

图片

曦望方面认为,当前,AI算力竞争正从追求性能峰值,转向推理时代的性价比与TCO(总拥有成本)。以存储为例,高通、英特尔等全球头部企业的推理产品正在采用LPDDR方案,LPDDR 工艺成熟、供应链充足,易于扩产。这一技术路径的切换,为产业提供了“换道超车”的战略窗口。

此前,在今年的世界人工智能大会(WAIC)期间,曦望Sunrise董事长徐冰曾用一个比方解释曦望押注大容量内存路线的逻辑,“在Agent系统里,内存容量不只是显卡的一个配置参数,它是数字员工的工位。工位越大,一台机器养得起的Agent越多,每个Agent记得住的事越久。”他同时强调,极高带宽场景与训练负载仍更适合HBM(高带宽内存),曦望要证明的是,在长上下文、高并发等容量敏感的Agent负载上,大容量内存加全栈协同能够做出更低的真实任务成本。

今年是行业公认的“AI智能体元年”,随着大模型从“会聊天”进化为“会思考、会执行”的数字员工,推理需求迎来爆发式增长。“AI算力基建的重心已彻底切换”。徐冰表示,“2026年AI推理计算需求将达到训练需求的4-5倍,推理算力租赁价格半年涨幅近40%”。

而据曦望方面介绍,S3通过计算层的深度定制,解决了通用GPU“算力用不满”的核心痛点,推理性能较上一代S2提升5倍,目标实现Token成本下降90%。“S3不是简单的性能升级,而是一次对AI推理成本曲线的重构。”徐冰表示,“我们的目标是将推理成本降至‘百万Token一分钱’,让AI像水电一样成为普惠基础设施”。


采写:南都N视频记者 朱可轩

南都N视频,未经授权不得转载、授权联系方式
banquan@nandu.cc. 020-87006626