职位描述
岗位职责
负责AI Native产品核心功能测试,包括多轮对话、上下文记忆、RAG检索、Agent/工具调用、文生图/文生视频等场景,完成测试方案设计、用例编写与版本回归。
负责大模型效果评测,发现并验证幻觉、逻辑错误、语义偏差、多轮对话不一致等问题,持续优化AI交互体验。
负责AI内容安全与合规测试,包括Prompt注入、越狱攻击、违规内容生成等风险场景验证。
负责RAG、工具调用等核心模块测试,关注检索准确率、任务成功率及系统稳定性。任职要求
任职要求
本科及以上学历,计算机、软件、AI相关专业优先,1-3年AI产品测试经验,有大模型/多模态产品测试经验优先。
熟悉软件测试流程、用例设计、缺陷管理及敏捷开发。
理解生成式AI、大模型基础原理,熟悉Transformer、幻觉、多轮对话、Prompt工程等核心概念。
熟悉对话、RAG、Agent、多模态生成等AI场景测试方法,能够设计高质量测试Prompt并挖掘复杂边界问题。
了解AI模型评测指标,具备文本、多模态效果评测能力。
熟悉AI内容安全、风控及对抗测试场景。
技术能力
熟练使用Python,能够编写测试脚本及自动化评测脚本,熟悉Pytest等测试框架。
熟悉HTTP接口测试及常见调试工具,可独立完成接口测试与问题定位。
了解主流AI评测工具、数据分析及ML基础工具者优先。
加分项
有AI对话、文生图/视频、Agent、企业知识库RAG等AI Native产品测试经验。
有AI自动化评测体系、测试平台建设经验。
熟悉向量数据库、Prompt优化、大模型微调或AI内容安全测试者优先。