Appearance
📰 概要
2026年4月29日,商汤正式开源SenseNova-U1。
GPT-Image-2发布后,朋友圈刷屏了一周。
但免费用户一天只能生成几张,中等难度的任务额度马上用完。
商汤的回应是:开源一个统一理解+生成的模型SenseNova-U1,小尺寸版本只有8B参数(约80亿参数),却能复刻GPT-Image-2的多个拿手绝活——而且免费、无限使用。
🔍 解读
SenseNova-U1的核心创新是NEO-unify架构——把图像理解和生成统一在同一个表征空间里。
传统模型里,语义保真和像素保真是天敌:保了语义就丢像素,保了像素就稀释语义。U1让两者共享上下文,第一次同时拿住。
这让它能做连续性图文创作:文字和图片在一段输出里自然交叠,而不是各管各的。比如生成一份「煎牛排教学」,每一步都有图,牛排形象从头到尾高度一致。
💎 深挖
8B打赢GPT-Image-2?
不是打赢,是「挤进一桌」。SenseNova-U1在开源模型中登顶,逼近主流商用闭源模型。这是国产开源模型的重要进步,但离GPT-Image-2的商用质量还有差距。
对于个人开发者和独立应用,这个8B版本足够用了——而且无限免费。
什么时候值得跟进
如果你是开发者,需要图像生成/理解能力,SenseNova-U1值得测试。它支持连续性图文创作,这个能力在现有开源模型里并不常见。
全网开源,可以在魔搭和Huggingface直接下载。
什么情况不建议用
如果你的应用对图像生成质量要求极高,现有闭源模型(如GPT-Image-2)可能仍然是更稳定的选择。开源模型进步很快,但商用稳定性仍需验证。
