
Job description
我们是京东科技,作为京东集团旗下专注于以技术为产业服务的业务子集团,秉承“以科技引领产业数智化升级,推动世界更加高效和美好”的使命,为企业和金融机构等客户提供全链条的技术产品与服务。我们目前已服务超95%的央企、超2500家大型企业、944家金融机构和超250万家中小微企业。在供应链金融领域,以数智供应链+供应链金融的“双链联动”模式,面向企业和金融机构输出供应链金融科技平台的技术及运营能力,助力产业链上的中小微企业高效便捷获得融资服务。在企业服务领域,基于全栈式云服务产品,帮助企业实现数智化升级。加入我们,一起用技术让生活更美好!
【岗位职责】 1.搭建与迭代模型评测体系,针对不同业务场景,定义多维度的评估指标,设计并推动自动化评测集机制,同时搭建高效的人工标注与验收流程; 2.模型效果调优与策略制定,建立常态化的 BadCase 归因分析机制,设计SFT、RLHF训练数据策略,包括数据清洗标准、样本配比、合成数据等; 3.结业务场景与模型能力,平衡效果、延迟与成本,设计线上用户反馈机制,将用户行为数据转化为模型训练的高质量样本,构建反馈优化的数据飞轮。
任职要求 / Qualifications: 【任职要求】 1.本科及以上学历,有搜索推荐算法策略背景,或 NLP 领域从业背景优先; 2.具备算法产品经验,其中至少 1 年以上 LLM 相关实战经验; 3.具备0 到 1 搭建模型评测体系的经验,或主导过大规模复杂场景下的模型效果优化项目; 4.深刻理解 Transformer 原理,熟悉主流开源模型的特性;理解 Pre-train, SFT, RLHF, RAG 的全流程逻辑;熟悉业界主流评测集(如 C-Eval, MMLU, GSM8K),并能针对垂直领域设计专有的评测集; 5.具备极强的数据敏感度,熟练使用 Python 或 SQL 进行数据分析和 Case 挖掘(不仅仅是看报表,能自己动手洗数据者加分); 6.对模型效果提升有执念,能够通过指标拆解将模糊的“体验好坏”转化为可量化的技术目标; 7.符合京东价值观:客户为先、创新、拼搏、担当、感恩、诚信。