大模型 · 机器人 · 精选
机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理
来源:量子位 · 2026年9月4日 17:19
摘要
星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL
这是 Future Frontier 对外部来源的精选摘要。我们保留原始来源和链接,不全文转载,不将外部内容标记为原创。
- 来源:量子位
- 标签:大模型 · 机器人
- 内容属性:精选
大模型 · 机器人 · 精选
来源:量子位 · 2026年9月4日 17:19
摘要
这是 Future Frontier 对外部来源的精选摘要。我们保留原始来源和链接,不全文转载,不将外部内容标记为原创。