Appearance
📰 概要
2026年4月,小米正式开源万亿参数大模型,采用MIT协议。 支持1M上下文窗口,提供完整训练代码和模型权重。
但发布会上坦诚"打不过DeepSeek",引发行业热议。 这不是谦虚,而是实力差距的诚实表达。
🔍 解读
小米的开源策略很清晰:用MIT协议的低门槛换取开发生态。 1M上下文窗口是对标Claude和DeepSeek的差异化卖点。 万亿参数规模展示技术能力,但性能未达到第一梯队水平。
坦诚"打不过"反而赢了口碑。在开源社区,诚实比吹牛更容易获得好感。 小米的定位是"够用且开放"——不争第一,但做最实用的开源选择。
💎 深挖
什么情况不建议用小米万亿模型替代DeepSeek?如果你的场景对推理质量要求极高, 小米模型当前的benchmark表现确实逊色于DeepSeek-R1系列。但如果是内部原型开发、实验探索, MIT协议+1M上下文的组合可能是更好的选择。
小米的入局让国内开源大模型竞争的格局更加清晰:DeepSeek走技术领先路线, 阿里走生态路线,小米走开放路线。三家各有定位,开发者有更多选择。
开源万亿级模型本身的技术意义不可低估。GPU算力成本在2026年仍然很高, 小米愿意把万亿参数模型免费开放,说明其战略重心在硬件生态而非模型本身。
