Token导航 LogoToken导航TokenDH.com

杭州芯片黑马,飙上200亿

更新时间 2026-09-03来源 21世纪商业评论正文 2255字阅读约 8分钟11 张图片

图片

撰文丨李惠琳 编辑丨鄢子为

国产GPU,跑出一匹黑马。

8月底,曦望完成20亿元新一轮融资,投后估值飙升至200亿元。

这家杭州芯片企业,4月刚完成超10亿元融资,跻身百亿估值阵营。不到半年,估值翻倍。

曦望不是“新手”,而是脱胎于商汤科技芯片部门的企业,由其联合创始人徐冰领衔。

图片徐冰

国产芯片牌桌上,多数玩家主打通用型技术路线。曦望选择走一条更垂直的路:all-in推理,目标是百万Token只需一分钱

“训练市场是头部玩家的游戏,门槛越来越高。推理是百花齐放的,需求看不到天花板。”徐冰曾在接受21记者采访时提到。

三人搭档

曦望快速起势背后,徐冰是关键推手。

接手该企业前,他主要负责商汤投融资工作,曾带领团队完成数次大额融资。

入局曦望,无异于二次创业。

“如果继续在商汤,就是挑简单的事去做的状态。”徐冰解释,人机共生的状态即将出现,如果不冲在最前面,解决最难的问题,就是在躺平。

图片

曦望原本是商汤的AI芯片预研项目,2020年,以“上海阵量智能”之名成立,作为商汤全资子公司,专做芯片。

其相继推出启望S1、S2,并量产落地,但作为内部项目,其潜力始终无法释放。

为此,徐冰亲自挂帅搭建班底,力邀王勇、王湛加盟,并委以联席CEO之职。

图片

王勇拥有20余年芯片研发经验,曾任AMD GPU首席架构师、百度昆仑芯高级研发工程师;王湛为百度创始团队成员、百度搜索“凤巢”系统的总设计师。

二人加入曦望后,一个主导研发和量产,一个建立商业化体系,与徐冰组成“铁三角”,投身国产GPU大潮。

2024年底,曦望分拆独立,融资提速。一年内,其完成了近30亿元战略融资,加上2026年两次融资,迄今融资额近60亿元

图片

2025年,曦望AI芯片交付已突破1万片。按这一交付规模,曦望已跻身国产GPU第一梯队

同期,徐冰卸任商汤执行董事、董事会秘书职务。

其现有团队约400人,研发人员占比超过80%,核心技术骨干平均拥有15年行业经验。

天眼查显示,曦望目前有65位股东,其中商汤为最大单一股东,持股12.43%。

打下价格

资本押注的,是曦望的技术。

创立之初,徐冰决定,放弃走主流训推一体的路,all-in推理。

这既是差异化竞争策略,也是需求使然。

徐冰判断,AI产业正由训练驱动全面转向推理主导:“当Token变成可计价的商品,推理GPU就是在为这个商品降低成本。”

图片

与训练阶段的一次性投入不同,推理是持续性、高频次的算力消耗过程,每一次模型调用都在生成和消耗Token,需求庞大。

“过去一年,推理的Token增长了100倍。随着最近AI Agent等进一步普及,推理Token仍会以几十倍的速度成长。”年初,王勇公开表示。

初创期,曦望在all-in推理这条路上走得不够“绝”。

彼时已量产的两代GPU,启望S1和S2,定位推理,骨子里却是训推一体的设计逻辑。

图片从左至右为:启望S1、启望S2-M1、启望S2-X1

团队发现,S2在实验室里对标顶级GPU企业的产品,训推一体表现亮眼;到了客户真实的业务环境中,几乎全被用来跑推理场景。

这让团队决心做“减法”。

2026年初,启望S3发布,摒弃训练相关的技术组件,放弃昂贵、超高带宽的HBM,选择成本更低、容量更大的LPDDR6内存。以往这种内存常用于手机、笔记本电脑。

“在Agent系统里,内存不只是显卡的一个配置参数,它是数字员工的工位。”徐冰解释,“工位越大,一台机器养得起的Agent越多,每个Agent记得住的事越久。”

图片

启望S3采用大容量LPDDR内存,实现了更低的真实任务成本。单卡成本预计在2~4万元之间,推理性能较上一代S2提升5倍,Token成本下降90%。

徐冰的目标,是将推理成本降至百万Token一分钱,“让AI像水电一样成为普惠基础设施”。

据炜烨智算测算,曦望每百万Token价格约0.57元,低于行业7~14元的平均水平。

徐冰团队也已付出高昂成本:八年累计研发投入达20亿元,至今尚未盈利。根据商汤财报,曦望的前身上海阵量,2024年净亏损1.9亿元。

冲刺百亿

技术再好,也要市场买单。启望S3的量产和商业化落地,是徐冰团队接下来的重任。

第一代S1推理芯片于2020年量产,实现上万片交付及场景落地;S2已向金融、工业等领域规模化交付。

2024年曦望营收约24万元。徐冰透露,2025年收入大幅增长,拿下多个头部客户订单

图片

鉴于上年的低基数,增长本在预期内,其更需在长周期中经得起审视。

“S1、S2证明了三件事:我们能做出来……从S3开始,我们要和整个产业一起,把中国的推理成本彻底拉到‘百万Token一分钱’的新级别。”徐冰称。

未来两年,曦望将推出两款产品:启望S4推理GPU、启望S5-GPU芯片。

王勇公开称:“百万Token一分钱”目标,将在S3至S5迭代中逐步达成,并力争取得百亿元级收入。

图片

“国产GPU四小龙”中,规模最大的摩尔线程,2026年全年收入预计在40亿元左右

曦望的百亿目标,达成不易。

徐冰的野心,不只是卖芯片,更是要整体布局“芯片+系统+生态”。

图片

他计划,给产业提供推理GPU卡、一体化的服务器、整机、集群方案,让大家少走弯路;与AI巨头、算力厂商和芯片厂商合作,实现算力系统的推理分流,并成为成本优化层。

此前,曦望打造了产品矩阵,包括智望系列加速卡及模组、辰望系列服务器。

商业化的核心主力,是启望S3。曦望已拿下数个客户订单,并与浙江大学、三一集团、协鑫科技等机构签约。

签约易,批量交付难,尚未盈利更添紧迫感。未来,曦望需要在更多客户场景中,跑通商业化流程。

图片来源:曦望,除标注外

文章标签芯片应用落地
资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多