Skip to content
← Back to job listings

AI后端开发工程师

trip · 长宁区, 上海市, 中国

External listingFull-time11 months ago

About The Role

职位描述 负责大规模语言模型(LLM)及其他AI模型的在线服务部署、性能调优与推理加速,确保高并发、低延迟、高可用的模型服务。 负责设计和开发智能Agent运行框架,实现核心模块,包括不限于知识库存储与检索(RAG)、Agent的长短期记忆存储、对接多模型协作协议(如MCP/A2A)等新型交互机制。 探索和落地模型压缩、量化、动态批处理、服务化框架优化(Triton/TorchServe等)等推理优化技术。 负责搜索推荐算法工程后端系统的设计、开发和维护,保障系统稳定高效运行,实现高并发在线特征工程、模型推理服务集成和服务质量监控等核心模块。 负责系统架构的设计、优化及核心模块的代码实现(Java为主)。 与产品经理、算法工程师、前端工程师紧密协作,理解需求,设计技术方案并推动落地。 负责系统的日常维护、监控、故障排查和性能调优。 任职资格 有算法平台开发或与算法团队深度合作经验,特别是模型部署、模型在线推理服务的实际项目经验。 具备大语言模型或复杂模型在线部署(Triton, TorchServe, TensorFlow Serving)、性能调优和推理加速的实际项目经验。 具备智能Agent系统核心模块(如知识库/RAG/记忆管理/工具调用)的设计或开发经验,熟悉相关框架(LangChain/LlamaIndex/MCP/A2A协议)和向量数据库。 负责过C端高并发系统的设计、开发和稳定性保障。 具备架构设计能力、抽象能力和平台化落地经验,有成功主导或深度参与中大型平台项目的证明,具备独立负责和推动复杂技术项目从设计到上线的全流程能力。 精通Java后端开发语言,具备深厚的编程功底和面向对象编程思想,熟练使用MySQL、Oracle等关系型数据库,具备数据库设计、优化和故障排查能力,熟悉实时数据处理技术栈,如Flink、Kafka等,有实时数据处理任务实战经验。

This is an external listing. JobSpring does not represent or verify the employer. Report this listing