← Back to job listings
ST
语音大模型算法研究员
step · 海淀区, 北京市, 中国; 徐汇区, 上海市, 中国
About The Role
工作职责 1、主导或深度参与语音多模态大模型的架构设计、训练、调优及迭代工作,提升模型整体性能,研究方向包括但不限于音频表征、音视频理解、语音生成、全双工语音对话、语音强化学习; 2、跟踪学术界与工业界的前沿技术动态,能够复现最新成果,推进技术迭代与创新突破; 3、系统性设计并执行实验方案,深入分析模型表现,定位核心问题并提出有效的优化与解决方案; 4、参与团队合作,与团队一起解决技术难题,推动技术进展; 职位要求 1、985/211高校研究生及以上学历或优秀本科生,计算机、人工智能、软件、数学等相关专业; 2、精通常用算法和数据结构, 熟悉Python等编程语言, 熟悉Linux平台; 3、熟悉机器学习、深度学习,具备扎实的算法基础, 熟练使用Pytorch/Megatron深度学习框架; 4、在语音多模态大模型某一领域(端到端语音、语音识别与理解、语音合成、Voice Agent)有过深入的研究经历; 5、具备卓越的实验分析与问题解决能力,有创新思维与较强的学习能力,能够良好沟通、与团队成员高效协作。 加分项 1、有顶级学术会议(ICASSP、Interspeech、ACL、ICML、NIPS、CVPR等)发表过有影响力研究成果的优先; 2、在 ACM/ICPC、NOI/IOI、Kaggle 等编程/AI 比赛获奖者优先; 3、主导、参与过 AI 相关的有大影响力的开源/闭源项目的优先;
This is an external listing. JobSpring does not represent or verify the employer. Report this listing
JobSpring