Job description
【岗位职责】 1、设计并实现手术室实时视频分析系统,精准识别三方核查、铺单、患者跌倒等特定行为,优化目标检测、姿态估计、动作识别等算法在复杂医疗环境中的鲁棒性。 2、开发医疗影像(CT/MRI)三维重建与图像配准技术,支持手术导航、病灶定位等临床需求。 3、构建医疗领域专用大模型(LLM/VLM),结合文本、影像、时序数据等多模态信息,优化RAG、LoRA微调、提示工程技术,提升模型在医学问答、诊疗推荐等场景的准确性。 4、探索多模态语义对齐与融合方法(如CLIP、BLIP、LLaVA),增强模型对跨模态医疗数据的理解能力。 5、跟踪LLM、AI视觉领域最新进展(如MoE架构、Diffusion生成模型),推动RLHF、小样本学习等技术在医疗数据受限场景的应用创新。 6、主导算法从原型到产品的全链路落地,协同医学团队确保模型符合临床合规性与安全性要求。 【任职要求】 1、计算机科学、人工智能、生物医学工程相关硕士学位 2、熟练掌握计算机视觉算法(如目标检测、动作识别、姿态估计等),具备实时视频分析能力,能够实现手术室内特定行为(如三方核查、铺单、患者跌倒等)的精准识别与分类。熟悉CT/MRI三维重建、图像分割及配准技术优先。 3、熟悉LLM的微调、提示工程及领域适应技术,能构建医疗领域专用模型,能够结合文本、影像等多模态数据,增强模型的临床实用性。 4、具备独立研究能力,能快速跟进LLM,AI视觉领域最最新进展并实现创新应用。 优先条件 1)在CVPR/ICLR/MICCAI等顶会发表过医疗AI相关论文,或主导过开源项目(如医疗知识图谱、手术行为数据集)。 2)熟悉医疗合规标准(HIPAA/GDPR)、模型隐私保护技术。 3)交叉学科背景(临床医学/药学)或三甲医院合作项目经验