← 返回新闻列表
量子位 🗓️ 2026-09-04

机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理,业内人士怎么看?

⚡ 一句话看懂:星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL

机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理 量子位的朋友们 2026-09-04 17:19:29 来源: 量子位 星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL 真实机器人没有“暂停键”。

现在的 VLA、World-Action Model 往往一次生成未来一段时间的动作序列,也就是 action chunk。

模型越来越大,推理时间也越来越长,但机器人不能每隔几百毫秒就停下来等模型推理下一段时间的动作。

尤其在投掷这类高动态任务里,一次停顿就可能让已经积累起来的速度掉下去,导致整个任务失败。

所以真实部署里更常见的方式是

🔗 原始来源

如果你要核对细节,可以再看原文: 量子位原文链接