Appearance
📰 概要
2026年4月23日,曦望科技以10亿元最新一轮融资,成为国内首家估值超百亿的纯推理GPU独角兽。这家公司在分拆独立仅1年多时间里,完成七轮融资累计40亿元。CEO王湛表示,谁的推理成本更低谁就是赢家,百万Token单价目标降至1分钱。
对比来看,国内大多数GPU公司都在卷训推一体、拼峰值算力,而曦望选择All in推理路线。在英伟达GTC推出Groq LPU、国产版Groq概念火热之际,曦望凭什么脱颖而出?
🔍 解读
说实话,这家公司能跑出来,有点超出预期。纯推理GPU在国内不算新概念,但真正能拿到百亿估值的,曦望是第一家。它的核心逻辑很直接:大模型推理才是当下最刚的需求,训练反而是少数大厂的事。
但有个前提:推理芯片的故事能不能讲通,取决于能不能真的把成本降下来。现在市场给它的估值,已经是在赌它未来能跑出量。如果推理成本降到1分钱/百万Token的目标实现,它的客户会爆发式增长;实现不了,这个估值就是空中楼阁。
💎 深挖
从时间线上看,曦望这一年的融资节奏有点快:
| 轮次 | 时间 | 金额 | 累计 |
|---|---|---|---|
| 第1-6轮 | 约1年内 | 约5亿元/轮 | 30亿元 |
| 第7轮 | 2026.04 | 10亿元 | 40亿元 |
40亿砸进去,估值过百亿。这个融资密度说明VC们是真的看好推理赛道。
横向对比更有意思。英伟达GTC 2026直接推出收购来的Groq LPU,推理速度号称行业最快。国内这边,曦望是国产版Groq的代表玩家。但两条路线不完全重合:Groq追求极致速度,曦望追求成本优先。
对芯片行业来说,这是一件标志性事件。训推一体是国内大多数GPU公司的主旋律,曦望反其道而行,All in推理。这有点像当年AMD专攻游戏GPU、避开数据中心的策略——先在一个细分市场站住脚。
今天下班前,想一个你项目里最耗token的场景:代码补全、长文本总结、多轮对话。算一下每个月花多少钱。如果每月Token费用超过500元,曦望这类推理芯片公司的产品可以关注一下。
但有个风险:推理芯片的稳定性需要时间验证,你现在用的是GPU大厂的方案,换新的有成本。这个阶段不建议追,等第一批企业用户跑通再说。
