Appearance
共 1 篇文章
普林斯顿大学开源OpenClaw-RL训练框架,边聊天边让OpenClaw自动学习进化。四异步模块架构、无需标注数据、支持二值强化学习+在线策略蒸馏+混合优化三种方法,越用越聪明。