
Job description
- 负责面向机器人操作任务的端到端模型研发,探索 Vision-Language-Action(VLA)模型在灵巧操作、长序列任务规划中的应用,推动通用操作策略的落地;
- 开展 World Model 相关研究,构建面向机器人操作的环境预测与动态建模能力,提升策略的泛化性和样本效率;
- 研究基于强化学习的高自由度灵巧手控制方法,包括 PPO、SAC、IQL等主流 RL 方法,探索仿真到真实的 Sim-to-Real 迁移技术;
- 负责大规模模型的训练基础设施搭建与优化,包括分布式训练、混合精度、推理加速及部署上线;
- 持续跟踪具身智能、操作学习、基础模型等领域的前沿进展,推动技术复现、改进与工程化落地。