Skip to content
← Back to job listings

大模型算法测试工程师(J19688)

Transsion Holdings · 上海市, 重庆市

External listingFull-time3 months ago

About The Role

岗位职责

  1. 负责大模型相关测评工作,包括但不限于模型性能、精度、安全性、鲁棒性、易用性等维度的测试设计与执行,输出专业测评报告,为模型优化提供数据支撑。
  2. 主导大模型测试交付全流程,制定测试计划、设计测试用例、搭建测试环境,执行测试用例、定位并跟踪问题,确保测试工作按时、按质完成,保障模型交付质量。
  3. 梳理大模型测试流程,提炼测试重点与难点,优化测试方法、用例设计及测试工具,提升测试效率和测试覆盖率。
  4. 配合算法、研发团队,对接测试需求,反馈测试过程中发现的问题,推动问题闭环,参与模型迭代优化的讨论与落地。
  5. 整理测试文档,包括测试计划、测试用例、测试报告、问题清单等,确保测试过程可追溯、可复盘。
  6. 关注大模型测试领域的新技术、新方法,结合业务场景落地到实际测试工作中,提升测试专业性。

任职要求

  1. 本科及以上学历,计算机、软件工程、人工智能等相关专业,5年及以上大模型测试、AI测试或相关测试经验。
  2. 熟悉大模型的基本原理、技术架构,了解常见大模型(如LLaMA、ChatGLM、文心一言等)的特性及测评方法。
  3. 具备扎实的测试理论基础,熟练掌握测试用例设计方法、缺陷管理流程,能独立完成测试全流程工作。
  4. 具备一定的编程能力,熟悉Python等编程语言,能使用脚本编写测试工具或自动化测试用例者优先。
  5. 具备良好的逻辑思维能力、问题分析与定位能力,能快速响应测试需求,高效推进测试工作。

加分项

  1. 有大模型测评项目、模型交付测试相关经验者优先。
  2. 熟悉自动化测试工具、性能测试工具,有AI模型性能测试、安全性测试经验者优先。
  3. 了解自然语言处理(NLP)、机器学习相关知识,能结合业务场景设计针对性测试用例者优先。
  4. 具备良好的沟通协调能力、团队协作意识,责任心强,能承受一定的工作压力。

This is an external listing. JobSpring does not represent or verify the employer. Report this listing