Skip to content
← Back to job listings

模型部署工程师(J28186)

Changan Auto · 重庆市

External listingFull-timeabout 2 months ago

About The Role

  • 1.模型移植与落地: 负责计算机视觉(CV)、语音(ASR、TTS)或大语言模型(LLM)在端侧设备(手机、车机、智能硬件)上的移植、适配与部署,打通从训练到推理的全流程。
  • 2.异构计算加速: 针对 CPU (ARM)、NPU (如高通、瑞芯微、地平线等)、GPU (Adreno, Mali) 等不同硬件架构,进行深度学习推理引擎的性能分析与算子优化,极致降低推理延迟和内存占用。
  • 3.模型压缩与量化: 负责模型的轻量化工作,包括但不限于模型剪枝、蒸馏,以及 FP16、INT8、INT4 量化(PTQ、QAT),在保证精度的前提下提升运行效率。
  • 4.推理引擎开发、集成: 维护或开发高性能推理引擎(如 TNN, MNN, NCNN, TensorRT, SNPE、QNN, RKNN 等),解决模型在特定硬件上的兼容性问题。
  • 5.系统级优化: 结合操作系统(Linux、Android、RTOS)特性,解决 AI 功能在端侧运行时的发热、功耗、多线程调度及资源竞争问题。
  1. 学历专业要求: 本科及以上学历,计算机相关专业
  2. 工作经验要求:有端侧 AI 模型部署及性能调优经验优先
  3. 专业技能要求:精通 C、C++,熟悉 Python;熟悉 PyTorch、TensorFlow、ONNX 模型转换;熟悉 TensorRT、MNN、TNN、SNPE 任一推理引擎,有 INT8 量化经验;熟悉 ARM NEON 或 CUDA、OpenCL异构计算编程
  4. 综合素质要求:具备较强的沟通、学习能力,以及分析和解决问题的能力,有较强的责任心

This is an external listing. JobSpring does not represent or verify the employer. Report this listing