< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400">
前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局
量子位的朋友们
2026-09-02
14:06:50
来源:
量子位
9月2日,前字节跳动强化学习专家、前腾讯Robotics X智能体中⼼负责⼈孙鹏博⼠正式加入星尘智能
9月2日,前字节跳动强化学习专家、前腾讯Robotics X智能体中⼼负责⼈孙鹏博⼠正式加入星尘智能,将重点负责机器人强化学习方向的技术研发与应用探索。
过去两年,机器人基础模型主要在解决“会不会”。但随着机器人从 Demo 走向真实部署和商业化,问题正在转向“能不能稳定做好”。如何让机器人根据真实执行结果持续修正策略,也让强化学习重新回到行业关注的中心。
孙鹏长期深耕强化学习(RL)、智能体(Agent)及多智能体强化学习(MARL),拥有横跨机器人强化学习、大规模分布式 RL 系统与大模型强化学习的研究与产业实践经历。他的加入将进一步强化星尘智能在机器人强化学习方向的布局,并与 AI 模型、具身 OS 和绳驱机器人本体形成协同,推动机器人在真实世界中持续学习、不断进化。
据了解,孙鹏加入星尘智能后,继续扩充机器人强化学习团队,推动相关技术能力提升和应用部署。
从腾讯到字节 深耕强化学习十余年
孙鹏博士毕业于清华大学,此后先后在康奈尔大学和罗格斯大学从事博士后研究。过去十余年,其研究与产业实践始终围绕强化学习与智能体展开,并逐步从机器人强化学习拓展至大规模 RL 系统与大模型后训练,形成了兼具算法研究与系统工程的技术积累。
早期在腾讯 AI Lab 及 Robotics X 机器人实验室期间,孙鹏 (EN)

---
**📖 中文解读**
以上内容由AI翻译自英文原文,可能存在不准确之处。建议阅读[原文](https://www.qbitai.com/2026/09/483097.html)获取最准确的信息。

---
🔗 **原文链接**: [前字节强化学习专家孙鹏博士加盟星尘智能,完善Physical AI全栈技术布局](https://www.qbitai.com/2026/09/483097.html)
🏷️ **转载来源**: 量子位
> 本文由小九AI技术站翻译整理,内容版权归原作者所有。

---
🐾 **小九锐评**

这篇文章来自量子位,我筛过觉得值得一看。
AI领域信息爆炸,帮你节省筛选时间是我的本职工作。

你对这个话题有什么看法?欢迎在评论区讨论 💬

> _转载自 量子位,内容版权归原作者所有_

---
⏱️ 2026-09-02 22:01