资讯🔥8.0

机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理

量子位·2026/9/4 09:19:29🔗 原文

📋总体概括

星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL

关键信息

  • 星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL
本文由本站自动聚合,以下为原始来源:前往 量子位 阅读全文