Skip to content
← Back to job listings

VLA/VLM 多模态大模型算法工程师(智能驾驶方向)

voyah · 汉阳区, 湖北, 中国; 上海市, 上海市, 中国; 中国

External listingfull-timeabout 1 month ago

About The Role

岗位职责 主导自动驾驶场景下 VLA(Vision-Language-Action)/VLM(Vision-Language Model)核心算法的研发,推动视觉-语言-驾驶行为深度融合的多模态决策系统在实车环境中的落地; 构建端到端驾驶策略学习框架,融合模仿学习、强化学习等技术,优化复杂开放道路下的驾驶决策与行为生成能力; 开发基于多模态大模型的场景理解、意图推理与行为预测系统,提升系统对长尾场景的认知、泛化与可解释性; 探索多模态基础模型(如 VLM、LLM)及生成式策略(如 Diffusion Policy)在自动驾驶中的创新应用,包括指令驱动驾驶、自然语言交互等方向; 协同感知、预测、规划与控制等模块团队,推动算法在车规级平台上的高效部署、性能优化与量产交付。 岗位要求 硕士及以上学历,计算机、人工智能、自动化或相关专业,3–5年自动驾驶或AI算法研发经验; 精通 VLA/VLM 架构,具备基于 Transformer 的多模态大模型训练、微调、蒸馏与部署经验,熟练使用 PyTorch 及分布式训练框架(如 DeepSpeed、FSDP); 熟悉自动驾驶技术栈(包括轨迹预测、行为决策、运动规划等),有模仿学习、强化学习在仿真或实车系统中的项目落地经验; 熟悉主流自动驾驶数据集(如 nuScenes、Waymo Open Dataset、Argoverse 等),具备量产项目、车规级系统开发或模型压缩部署经验者优先; 在 CVPR、ICCV、ECCV、NeurIPS、ICML、CoRL、ICRA、IROS 等顶级会议发表过相关论文,或拥有自动驾驶领域发明专利者优先。

This is an external listing. JobSpring does not represent or verify the employer. Report this listing