Appearance
共 11 篇文章
陈博远是GPT Image 2主训工程师,OpenAI少数亲自走到台前的研究员。MIT博士、DeepMind背景,长期研究"世界模型"——关心的不是"画得更像",而是模型如何理解时间和因果。他用图片做了整个博客。
魔法原子MagicLab在硅谷发布世界模型Magic-Mix,日均采集16000条数据,目标2036年营收140亿美元。这是具身智能行业从VLA路线向世界模型路线演进的关键节点。
银河通用于2026年4月28日发布LDA-1B跨本体世界-动作基础模型,1.6B参数,首次实现虚拟仿真和真实数据、有无标注的异构数据统一训练,1小时跨本体自适应,性能提升48%,登顶RSS 2026。
2026年4月,银河通用发布LDA-1B具身基础模型(1.6B参数),走WAM世界-动作融合路线。首次实现仿真/真实/人类/机器人/有标签/无标签数据统一训练,1小时跨本体自适应。登顶RSS顶会,估值超200亿元。
2026年4月,生数科技认领神秘登顶模型MotuBrain,同时登顶WorldArena和RoboTwin2.0双榜。前身为视频大模型Vidu的开发团队,用U-ViT架构统一视觉与动作建模,跑通插花、调酒等高难度长程任务,完成20亿元B轮融资。
2026年4月30日,Runway CEO认为AI视频只是前传,世界模型是未来,AI发展进入新阶段。
2026年4月27日消息,灵光在手机端上线世界模型功能,实时体验触手可及,AI模拟技术进入消费级市场。
2026年4月27日消息,蚂蚁灵波开源LingBot-World-Fast实时世界模型,世界模型能实时玩了,AI模拟器进入新阶段。
2026年4月27日蚂蚁灵光App今日上线体验世界模型功能,世界模型首次搬进手机,AI手机迎来新突破。
跨维智能DexWorldModel在RoboTwin取得94%平均成功率,零样本Sim2Real超过π0和GR00T N1.5。四层协同架构:CLWM因果潜空间表示、Dual-State TTT Memory常数内存、SAI预去噪降低50%延迟、EmbodiChain在线数据流。VLA开创者Pete Florence宣布抛弃VLA路线。
高德发布首个面向AGI的全栈具身技术体系ABot,横扫全球15项SOTA,在CVPR 2026 Workshop上分数超过谷歌英伟达。双引擎架构:ABot-3DGS数字孪生工厂+ABot-PhysWorld 14B物理思维引擎。ABot-World已开源。