
Job description
团队介绍: 我们是京东云,作为京东集团面向企业、政府等机构的技术服务品牌,是更懂产业的数智化解决方案提供商,致力于为企业、金融机构、政府等各类客户提供以供应链为基础的数智化解决方案。依托公、专、混的全栈式云产品矩阵,我们融合了人工智能、大数据、物联网等前沿科技,在零售、物流、健康、智能城市、金融科技等行业领域为客户提供了丰富的产品与数字化解决方案,帮助客户降低成本、提升效率,是值得信赖的产业数字合作伙伴。 岗位职责:
- 大语言模型/多模态大模型SFT微调、指令跟随、后训练RLHF精调与偏好对齐;
- 大语言模型/多模态大模型强化学习Reasoning模型算法、Reward模型、Verifier等算法研发;
- 大语言模型/多模态强化Reasoning大模型长CoTs效率效果优化与RL Scaling-law研究;
- 大语言/多模态大模型Agent算法研发;
- 大语言/多模态大模型强化学习Test-time Compute在线推理算法研发。
任职要求 / Qualifications:
- 硕士及以上学历,计算机、数学、人工智能及STEM等相关专业;
- 拥有扎实的计算机科学功底和编程能力,熟悉常见算法和数据结构,具有良好的编程习惯;
- 熟悉语言或多模态模型的基本算法、模型结构及基础技术,相信AGI和对相关工作抱有热情;
- 工作认真务实,科学规划,具有极致的探究精神且知行合一,具备较强的责任感; 加分项:
- 有大模型相关的顶会论文的工作者优先;有STEM竞赛经历者优先;
- 熟悉强化学习算法和框架相关技术和细节,曾深度参与后训练/强化推理大模型/Agent等项目;
- 具有扎实的工程能力,熟悉开源大模型相关工具使用,有积极提升效果效率的意识。
符合京东价值观:客户为先、创新、拼搏、担当、感恩、诚信。