Skip to content

国内首家百亿纯推理GPU独角兽诞生,曦望联席CEO王湛称谁推理成本低谁赢

2026年4月28日

📰 概要

2026年4月23日,曦望科技以10亿元最新一轮融资,成为国内首家估值超百亿的纯推理GPU独角兽。这家公司在分拆独立仅1年多时间里,完成七轮融资累计40亿元。CEO王湛表示,谁的推理成本更低谁就是赢家,百万Token单价目标降至1分钱。

对比来看,国内大多数GPU公司都在卷训推一体、拼峰值算力,而曦望选择All in推理路线。在英伟达GTC推出Groq LPU、国产版Groq概念火热之际,曦望凭什么脱颖而出?


🔍 解读

说实话,这家公司能跑出来,有点超出预期。纯推理GPU在国内不算新概念,但真正能拿到百亿估值的,曦望是第一家。它的核心逻辑很直接:大模型推理才是当下最刚的需求,训练反而是少数大厂的事。

但有个前提:推理芯片的故事能不能讲通,取决于能不能真的把成本降下来。现在市场给它的估值,已经是在赌它未来能跑出量。如果推理成本降到1分钱/百万Token的目标实现,它的客户会爆发式增长;实现不了,这个估值就是空中楼阁。


💎 深挖

从时间线上看,曦望这一年的融资节奏有点快:

轮次时间金额累计
第1-6轮约1年内约5亿元/轮30亿元
第7轮2026.0410亿元40亿元

40亿砸进去,估值过百亿。这个融资密度说明VC们是真的看好推理赛道。

横向对比更有意思。英伟达GTC 2026直接推出收购来的Groq LPU,推理速度号称行业最快。国内这边,曦望是国产版Groq的代表玩家。但两条路线不完全重合:Groq追求极致速度,曦望追求成本优先。

对芯片行业来说,这是一件标志性事件。训推一体是国内大多数GPU公司的主旋律,曦望反其道而行,All in推理。这有点像当年AMD专攻游戏GPU、避开数据中心的策略——先在一个细分市场站住脚。

今天下班前,想一个你项目里最耗token的场景:代码补全、长文本总结、多轮对话。算一下每个月花多少钱。如果每月Token费用超过500元,曦望这类推理芯片公司的产品可以关注一下。

但有个风险:推理芯片的稳定性需要时间验证,你现在用的是GPU大厂的方案,换新的有成本。这个阶段不建议追,等第一批企业用户跑通再说。

不要孤军奋战啦!

加入微信群一起学习交流 AI

与大神一起使用 OpenClaw、Hermes、Claude Code、Seedance 2.0、GPT-Image-2 等

微信公众号

扫码关注微信公众号
私信 "加群",将自动获取微信群二维码

探索 AI 世界,掌握智能未来