China Mobile Communications

算法工程师(多模态大模型方向)-拔尖计划

China Mobile Communications

北京 / 北京市-昌平区Posted Mar 9, 2026

Job description

职位描述 / Description: 岗位职责: 1、负责多模态大模型(语音、图像等)的算法研究与开发,重点聚焦语音相关技术的创新与优化。 2、深入研究和实现语音识别(ASR)、语音合成(TTS)、语音情感分析、语音理解(SLU)等核心算法。 3、探索多模态融合技术,提升语音与其他模态(如文本、图像)的协同效果。 4、针对实际业务场景,优化模型性能,解决语音处理中的噪声、口音、低资源语言等挑战。 5、跟踪学术界和工业界的最新进展,将前沿技术应用于实际产品中。 6、与产品、工程团队紧密合作,推动算法模型的落地应用。

任职要求 / Requirements: 教育:硕士(含)研究生及以上学历,专业要求是计算机,电子信息工程,信号与信息处理等相关3T专业背景; 技能: 1、具备深度学习知识背景,熟悉kaldi,tensorflow,cntk等主流的语音深度学习框架; 2、熟悉C/C++ ,java至少一种编程语言,熟悉某一种或几种脚本语言(shell、python), 3、有实际项目编程经验;具备语音信号处理领域相关基础知识,熟悉语音相关技术,如语音识别(ASR)、语音合成(TTS)、语音增强、声学建模等。了解多模态大模型(如GPT、Whisper、CLIP等)的基本原理和应用。 熟悉常见的语音数据集和评测标准(如LibriSpeech、Common Voice、WER、CER等)。 经验:2年及以上相关工作经验

工作经验: 2

学历要求: 15