具身智能观察

机器人不能停下来等模型:星尘发布 SmoothRL,让在线强化学习跟上大模型的异步推理

星尘智能产业动态AI 92

来源:量子位发布时间待核实

星尘智能(Astribot) 基座模型团队发布能异步执行的在线强化学习框架 SmoothRL

相关动态