Appearance
共 7 篇文章
研究人员用只有1931年前知识的大模型talkie-1930-13b微调成软件工程师,250个训练样本就能写Python代码,成功解决SWE-bench真实编程问题。GPT系列之父Alec Radford参与操盘。
DeepSeek发布多模态大模型技术报告,提出「视觉原语」框架,将点、边界框从视觉输入提升为「基本思维单元」,实现精确空间推演。小模型比肩GPT-5.4、Claude-Sonnet。
量子位观察:1930年知识的大模型微调成软件工程师后,仅用250个样本就解决了第一个编程问题。但一个简单问题花了49轮才搞定。研究者既着急又兴奋。
引用量超10万的普林斯顿助理教授刘壮在播客访谈中指出:架构没那么重要,数据才是AI进步的根本驱动力。他同时认为记忆是AI当前最大瓶颈,LLM在语言空间中有世界模型,但自主科研能力仍未到位。
0博士组合拿下ICLR时间检验奖,学术圈热议,AI研究影响力与认可度引发关注。
横纵分析法深度研究Prompt,纵向追时间、横向追空间,半小时帮你搞懂任何陌生领域,附完整Prompt和Skill版本。
Google与Thinking Machines Lab达成数十亿美元新合作,深化AI研究伙伴关系,AI研究联盟加速构建。