← Back to job listings
ST
端侧VLM 算法研究员
step · 海淀区, 北京市, 中国
About The Role
【岗位职责】 模型研发与优化 1、负责多模态大模型(Vision-Language Model, VL/Omni)的研发与优化,重点面向端侧设备(移动端)。 2、设计与实现下一代的端侧友好的模型结构,针对特定芯片进行算法与系统的 co-design。 模型压缩与部署 1、研究并落地低比特量化(w4a8、w2a16、fp8),协助完成异构硬件(如 NPU)的模型部署。 任务场景落地 1、支持下游多模态 Agent、端云 Agent 协同、场景对话、实时感知等业务需求。 2、探索 VLM 在端上实时场景中的新应用。 【任职要求】 1、熟悉主流 LLM、VLM、Diffusion Model 的原理与实现,深度学习基础扎实。 2、熟悉 LLM、VLM 的预训练与后训练,熟悉模型压缩与加速技术(QAT、PTQ、fp8、蒸馏等)。 3、熟悉主流训练、推理、部署框架:Megatron、Deepspeed、vLLM、llama.cpp、TNN/MNN 等,有实际的 项目经验。 4、良好的代码能力。 【加分项】 1、熟悉使用 Cuda、Triton 等工具进行细粒度性能优化。 2、系统性掌握前沿的 LLM/VLM 的算法与训练方法论,包括 Scaling Law、MoE、Linear/hybrid Attention、MTP 等。
This is an external listing. JobSpring does not represent or verify the employer. Report this listing
JobSpring