Appearance
共 1 篇文章
DeepSeek发布多模态大模型技术报告,提出「视觉原语」框架,将点、边界框从视觉输入提升为「基本思维单元」,实现精确空间推演。小模型比肩GPT-5.4、Claude-Sonnet。