EN
中
← AI资讯
资讯
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
📅 2026-09-04 · AI导航编辑部
星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL
星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL
来源:
https://www.qbitai.com/2026/09/484437.html