Skip to content
← Back to job listings

VLM预训练研究员-视频方向

moonshot · 黄浦区, 上海市, 中国

External listingfull-timeabout 1 year ago

About The Role

工作内容: 1. 参与 Kimi-VL 等视觉语言模型的预训练和post-training部分,优化模型在长视频理解、长文档阅读等问题中的表现,提升模型的准确性和效率。 2. 对在大语言模型上学习视频进行研究和探索,结合 Kimi 产品的特点和优势,探索新的算法和架构,提高模型在视频场景下的模型泛化能力。 3. 负责数据的优化、质量提升等工作,以满足模型训练和优化的需求;深入分析数据特点和模型输出结果,为模型改进提供有力依据。 4. 设计并实施视频相关的强化学习模型的评估指标和方法,对模型进行性能评估和分析;找出模型存在的问题和不足,提出切实可行的改进方案。 岗位要求 1. 计算机科学、人工智能、机器学习、数学等相关专业的研究生及以上学历。 2. 相关技术能力: * 熟练掌握 Python 编程语言,具备扎实的编程基础和数据结构知识。 * 熟练使用深度学习框架(如 PyTorch 或 TensorFlow),具有使用这些框架进行模型训练和开发的丰富经验。 * 了解视觉强化学习的基本概念和原理,对相关算法(如 PPO、A3C 等强化学习算法)和模型架构(如视觉编码器、Transformer 等模型架构)有一定的研究和实践经验。 3. 有参与机器学习、深度学习或强化学习相关项目的经历,熟悉模型训练、优化和部署流程,具备独立完成项目任务的能力;有在视觉强化学习领域的项目经验者优先。 4. 具备良好的文献阅读和理解能力,能够快速掌握最新的视觉强化学习研究动态和技术趋势;对发表过相关领域论文者优先。 5. 具有良好的团队合作精神和沟通能力,能够与团队成员密切合作,共同推进项目的进展。

This is an external listing. JobSpring does not represent or verify the employer. Report this listing