时代周报 昨天
字节前强化学习专家孙鹏加盟星尘智能,加码机器人强化学习后训练
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

本文来源:时代周报

9 月 2 日,字节跳动前强化学习专家、腾讯 Robotics X 智能体中⼼前负责⼈孙鹏正式加入星尘智能,将重点负责机器人强化学习方向的技术研发与应用探索。

孙鹏长期深耕强化学习(RL)、智能体(Agent)及多智能体强化学习(MARL),拥有横跨机器人强化学习、大规模分布式 RL 系统与大模型强化学习的研究与产业实践经历。据了解,孙鹏加入星尘智能后,将继续扩充机器人强化学习团队,推动相关技术能力提升和应用部署。

从成立之初,星尘智能就坚持 Design for AI,认为机器人身体、数据与 AI 模型不应被割裂设计。过去几年,这套思路已经逐步形成覆盖基座模型和商用模型、前端共生 Agent、强化学习后训练的完整闭环。

星尘智能的基座模型 Lumo 系列,持续推进机器人对环境与动作的理解、预测和生成,其中 Lumo-1 让机器人理解动作背后的 " 为什么 ",Lumo-2 作为首个家庭隐式世界动作模型,率先引入 Latent World Dynamics,在隐空间中先预测未来世界,再生成动作;前端的 Agent Philia,面向长期记忆、任务管理、多机器人协同与自然交互;而强化学习作为基础模型走向规模化真实部署的重要环节,承担了机器人如何从真实环境中的持续交互与任务反馈中学习,并不断优化自身的行为策略的关键命题。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

机器人 孙鹏 腾讯 任务管理 字节跳动
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论