语音前端算法工程师
上海
外包
互联网 / 电子 / 网游
职位描述
1、算法研发与优化 1)负责传统声音前端相关算法的研发工作,包括语音活动检测(VAD)、降噪、回声消除(AEC)、语音分离、声源定位(DOA)等。 2)负责语音唤醒算法和关键词检测算法开发,声纹和属性分类、语音事件检测等算法开发。 3)参与构建语音前端解决方案,围绕语音降噪、声纹识别等方向研发核心技术,并推动技术在实际场景中的落地应用。 4)持续跟踪业内前沿技术和方法,验证并探索新技术在业务场景中的有效性,不断提升语音前端各算法效果。 2、数据处理与挖掘 1)负责大规模语音数据集的预处理,包括数据清洗、标注、格式转换等,确保数据质量,为后续算法训练提供优质数据。 2)对语音数据进行挖掘和分析,提取有价值的信息和特征,为算法优化和模型训练提供支持。 3、工程实现与系统开发 1)负责语音信号前端处理的工程实现与系统开发,将算法量化部署工程化,确保系统的稳定性和高效性。 2)与其他团队(如后端算法团队、产品团队、硬件团队等)紧密协作,完成语音前端系统与其他模块的集成和对接,共同推动产品的研发和上线。
职位要求
职位要求 1、专业背景:计算机、数学、通信、声学、信号处理等相关专业,硕士及以上学历。 2、技能要求 1)编程能力,熟练掌握 C/C++、Python 等编程语言,熟悉 Linux 相关操作及 Shell 脚本。 2)熟悉深度学习框架,如 Pytorch、Tensorflow、Kaldi 等。 3)具备扎实的数字信号处理、语音信号处理基础,熟悉语音前端相关技术,如语音增强、回声消除、麦克风阵列等。 4、项目经验:有语音信号处理相关项目经验,如语音前端、语音唤醒、声纹识别等项目,有实际产品落地经验者优先。 5、论文发表:在相关国际会议或期刊(如 ICASSP、Interspeech 等)发表过学术论文者优先。 6、其他能力:具备良好的学习能力、逻辑思维能力、沟通协作能力,能够快速学习新知识和解决复杂问题。
投递

AGIBOT is an Embodied AI foundation model company developing both the intelligence layer and the corresponding robotic embodiments needed to bring general intelligence into the physical world. Founded in 2023, AGIBOT is building a full-stack Embodied AI platform across foundation models, data infrastructure, simulation, robotic hardware, and deployment. AGIBOT’s “Three Intelligences in One” architecture integrates Locomotion Intelligence, Interaction Intelligence, and Manipulation Intelligence into a unified embodied system. AGIBOT’s portfolio spans humanoid robots, quadrupeds, dexterous systems, and commercial cleaning solutions. In March 2026, AGIBOT announced that its 10,000th robot had rolled off the production line.