
Job description
1.探索具身智能领域前沿多模态大模型算法,特别是面向机器人感知、决策与控制的模型架构,探索世界模型、具身规划等关键概念在模型设计中的应用; 2.构建和迭代面向具身智能任务(如机器人操控、导航、人机协作)的专用多模态大模型基座,优化并实现数据采集/预训练/后训练/监督微调/人类反馈强化学习/思维链等算法能力; 3.推进多模态大模型在机器人平台的实际应用,将模型部署到真实机器人系统或高保真仿真环境中,构建“通用机器人大脑” 或 “具身世界模型” 的核心认知与决策模块; 4.探索和实现适合具身计算的模型架构改进(如高效注意力、模型压缩、知识蒸馏),优化模型在资源受限的端侧机器人平台上的推理效率。
任职要求 / Qualifications: 1.计算机视觉、多模态大模型、机器人等相关领域的硕士及以上学历; 2.有大语言模型/视觉模型/多模态大模型预训练/后训练/微调研发经验,如llava/llama/vit/diffusion等模型架构; 3.熟悉多模态领域算法,熟悉llava/qwenvl等基础vlm模型; 4.熟悉nlp领域算法,熟悉bert/gpt/llama等架构; 5.熟悉cv算法,包括不限于vit/dino/sam/gan/diffusion等架构。
符合京东价值观:客户为先、创新、拼搏、担当、感恩、诚信。