AI工程开发工程师
trip · 长宁区, 上海市, 中国
About The Role
**岗位职责** 1. 参与大规模语言模型(LLM)及其他AI模型的在线服务部署、性能调优与推理加速,确保高并发、低延迟、高可用的模型服务。 2. 参与设计和开发智能Agent运行框架,实现核心模块,包括不限于知识库存储与检索(RAG)、Agent的长短期记忆存储、对接多模型协作协议(如MCP/A2A)等新型交互机制。 3. 负责搜索推荐算法工程后端系统的设计、开发和维护,保障系统稳定高效运行,实现高并发在线特征工程、模型推理服务集成和服务质量监控等核心模块。 4. 参与系统架构的设计、优化及核心模块的代码实现(Java为主)。 5. 与产品经理、算法工程师、前端工程师紧密协作,理解需求,设计技术方案并推动落地。 6. 负责系统的日常维护、监控、故障排查和性能调优。 **职位要求** 1. 具有算法平台开发或与算法团队深度合作经验者优先,特别是具备模型部署、模型在线推理服务的实际项目经验。 2. 具备大语言模型或复杂模型在线部署(Triton, TorchServe, TensorFlow Serving)、性能调优和推理加速的实际项目经验者优先。 3. 熟悉智能Agent系统核心模块(如知识库/RAG/工具调用/记忆管理)的设计或开发,熟悉相关框架(LangChain/LlamaIndex/MCP/A2A协议)和向量数据库。 4. 必须负责过高并发C端系统的设计、开发和稳定性保障。 5. 具备较强的架构设计能力、抽象能力和平台化落地能力。 6. 必须精通Java后端开发语言,具备深厚的编程功底和面向对象编程思想。 7. 熟练使用MySQL、Oracle等关系型数据库,具备数据库设计、优化和故障排查能力。 8. 熟悉实时数据处理技术栈,如Flink、Kafka等,具有实时数据处理任务实战经验。
This is an external listing. JobSpring does not represent or verify the employer. Report this listing
JobSpring