
Job description
1、在 mentor 指导下深度参与 VLA / Embodied VLM / Embodied Agent / World Model 任一方向的算法研究; 2、参与预训练目标设计、模型架构探索、数据 pipeline 搭建与实验验证; 3、主导或共同推进至少一项可发表 / 可上真机的子任务; 4、与训练 / 推理 / 数据团队协同,跟踪并复现 SOTA 工作。 4、跟踪具身智能、多模态大模型、生成模型等前沿论文,进行复现、调研与方案对比,形成实验结论与技术洞察。 5、与算法、数据、Infra团队协作,推动研究方案在真实训练环境中的落地验证。
1、CV / ML / 机器人 / AI 相关方向博士,或具备长期科研意愿的硕士; 2、在 VLM / 多模态大模型 / 视频理解 / 3D 视觉 / VLN / Embodied Agent / RL / 视频生成 / 世界模型任一方向有研究基础; 3、有顶会论文(已录用 / 在审 / 投稿中)或高影响力开源项目者优先; 4、熟练 PyTorch,熟悉 Transformer / Diffusion / CLIP / SigLIP / Qwen-VL 等主流架构; 5、具备自驱力与好奇心,能独立推进研究课题。