0
0
0
0
在腾讯 AI Lab 与 Robotics X 机器人实验室任职期间,孙鹏担任智能体中心负责人。一方面开展机器人深度强化学习控制研究,依托对抗博弈算法完成轮式机器人端到端目标跟随能力;另一方面主导《星际争霸》系列博弈 AI TStarBots、TStarBotX 研发,在多智能体复杂博弈场景拿到突出研究成果。
转战字节跳动之后,孙鹏的工作重心延伸到大规模强化学习基础设施建设。他主导搭建 ByteRL 强化学习底层系统,支撑多款自研游戏 AI 高效训练。其团队拿下 IEEE CoG 2023 策略卡牌 AI 竞赛冠军,所研发的炉石传说 AI 具备击败顶尖人类选手的竞技实力。
当前不少具身模型在仿真环境、标准化测试集表现亮眼,一旦迁移到真实家庭、商业场景,就容易出现成功率下滑。单纯依靠预训练 + 示范数据,很难覆盖现实世界无穷无尽的边缘工况。
强化学习后训练闭环,核心价值就在于以真机真实反馈作为奖励信号,持续迭代模型策略,完成从实验室 Demo 走向商用落地的关键跨越。星尘智能依托绳驱机器人硬件底座、Lumo 基座模型、Philia 智能体,叠加孙鹏带来的强化学习工程能力,完整闭环已经成型,也为国内具身智能行业提供一条可参考的技术路线。
第三届中国具身智能与人形机器人创新峰会2026年12月22-23日会议主题:
诠释全球产业格局趋势
解析国家顶层政策与十五五规划
未来3年具身人形机器人产业红利导向
全产业链统一标准、接口互通、合规量产规范化
国产具身智能与人形机器人万台规模化量产元年路径
核心零部件与关节模组
具身智能大小脑协同与算法
灵巧手、整机研发与工艺升级
特种机器人与服务机器人场景规模化应用
网页链接 data-nest-level="6">大会组委会:
赵靖 18101623169