← Back to job listings
ST
大模型数据算法工程师-多模态方向
step · 海淀区, 北京市, 中国
About The Role
工作职责 多模态大数据处理链路开发/优化 1)设计、开发和维护基于Spark/Ray 的大规模自动化ETL Pipeline,处理PB级 *多模态* 图文数据 2)优化 图文数据的 准确性/丰富度,以更好的提升 Multimodal Model 的能力上限 岗位要求 计算机、大数据相关专业,本科及以上学历; 具备扎实的代码能力,熟悉 Python,熟悉多线程编程、分布式计算、网络通信、内存管理; 熟悉Linux环境,能编写Shell/Python脚本自动化日常任务; 熟练掌握如Spark、Hive、Hadoop等大数据处理工具/框架,有VLM数据管理/处理基建开发与设计经验 了解深度学习基础原理,以及多模态大模型基础原理 加分项 有丰富的多模态数据处理/挖掘经验者 优先 有大规模数据处理基建Pipeline 的 设计开发经验者 优先 有深度学习CV/NLP、多模态大模型训练经验者 优先
This is an external listing. JobSpring does not represent or verify the employer. Report this listing
JobSpring