Skip to content
← Back to job listings

前瞻技术研究岗(语音理解大模型算法)

geely · 海淀区, 北京市, 中国

External listingfull-time8 months ago

About The Role

岗位职责 1. 负责语音理解相关算法的实现和相关业务落地,包括语音识别,情感识别,语种识别,音频事件检测等; 2. 负责自监督、有监督预训练语音编码器算法研发,语音编码器接入LLM、语音端到端大模型、多模态大模型相关技术的研发和落地; 3. 有机会负责一个方向,参与从零到一的全链路研发工作。 岗位要求 1、音频、机器学习、语音、自然语言处理、机器视觉等相关专业硕士(AI,EE,CS,NLP)及以上学历 2、有情感识别(SER)和情感描述(SECaption)领域经验和车载场景经历者优先。 3、熟悉传统机器学习基础理论,熟练掌握Kaldi, TensorFlow, Pytorch等社区开源工具中的一种及以上,熟练C/C++,Python,Shell编程语言,对数据结构和算法设计有深刻理解,参加过ACM等编程比赛的优先 4、具备语音识别端到端声学建模(LAS,transformer,rnn-transcuder)经验,语音无监督预训练(wav2vec,hubert,wavLM等)专业背景,参与过大语言模型预训练、SFT、强化学习研发,有语音端到端大模型Audio Encoder+LLM架构实际研发经验、多模态大模型数据建设经验者优先 5、学习能力强,逻辑思维清晰,具有自我驱动力,有创造力,有较强的文献阅读能力,快速实现或设计音频相关算法,在相关国际会议或主流期刊上发表论文者优先(ICASSP,Interspeech,ASRU,CVPR、ICCV、ACL等)

This is an external listing. JobSpring does not represent or verify the employer. Report this listing