Skip to content

商汤开源SenseNova-U1:8B参数打赢GPT-Image-2,图像理解和生成统一了

2026年5月2日

📰 概要

2026年4月29日,商汤正式开源SenseNova-U1。

GPT-Image-2发布后,朋友圈刷屏了一周。

但免费用户一天只能生成几张,中等难度的任务额度马上用完。

商汤的回应是:开源一个统一理解+生成的模型SenseNova-U1,小尺寸版本只有8B参数(约80亿参数),却能复刻GPT-Image-2的多个拿手绝活——而且免费、无限使用。


🔍 解读

SenseNova-U1的核心创新是NEO-unify架构——把图像理解和生成统一在同一个表征空间里。

传统模型里,语义保真和像素保真是天敌:保了语义就丢像素,保了像素就稀释语义。U1让两者共享上下文,第一次同时拿住。

这让它能做连续性图文创作:文字和图片在一段输出里自然交叠,而不是各管各的。比如生成一份「煎牛排教学」,每一步都有图,牛排形象从头到尾高度一致。


💎 深挖

8B打赢GPT-Image-2?

不是打赢,是「挤进一桌」。SenseNova-U1在开源模型中登顶,逼近主流商用闭源模型。这是国产开源模型的重要进步,但离GPT-Image-2的商用质量还有差距。

对于个人开发者和独立应用,这个8B版本足够用了——而且无限免费。

什么时候值得跟进

如果你是开发者,需要图像生成/理解能力,SenseNova-U1值得测试。它支持连续性图文创作,这个能力在现有开源模型里并不常见。

全网开源,可以在魔搭和Huggingface直接下载。

什么情况不建议用

如果你的应用对图像生成质量要求极高,现有闭源模型(如GPT-Image-2)可能仍然是更稳定的选择。开源模型进步很快,但商用稳定性仍需验证。

不要孤军奋战啦!

加入微信群一起学习交流 AI

与大神一起使用 OpenClaw、Hermes、Claude Code、Seedance 2.0、GPT-Image-2 等

微信公众号

扫码关注微信公众号
私信 "加群",将自动获取微信群二维码

探索 AI 世界,掌握智能未来