职位详情

职位列表 通用 Agent 数据产品经理 3f017315f85cc8e9

测试工程师(软件测试 / AI Agent 测试)

15-25K·15薪 · 北京·海淀区·学院路 · 知为医

JD数据
{
    "schema_version": "via_ai_product_manager_jobs_v1",
    "data_type": "ai_product_manager_jobs",
    "job": {
        "job_title": "测试工程师(软件测试 / AI Agent 测试)",
        "job_level": "中级",AI生成
        "work_category": "全职",AI生成
        "department": "",
        "location": "北京·海淀区·学院路",
        "work_mode": "现场办公",AI生成
        "job_category": "AI软件测试工程师"AI生成
    },
    "company": {
        "company_name": "知为医",
        "company_industry": "医疗健康",
        "company_size": "0-20人",
        "company_website": "",
        "company_description": ""
    },
    "compensation": {
        "salary_range": {
            "min": 15000,
            "max": 25000,
            "currency": "元",
            "cycle": "月"
        },
        "benefits": "五险一金"
    },
    "requirements": {
        "working_years": 1,
        "degree": "本科",
        "language": "中文",AI生成
        "visa_support": "",
        "responsibilities": "1. 负责 Web、服务端及相关业务系统的测试工作,包括需求分析、测试方案设计、测试用例编写、测试执行和缺陷跟踪。\n2. 开展功能、接口、兼容性、性能、稳定性、安全性及回归测试,保障产品交付质量。\n3. 负责 AI Agent 产品的专项测试,覆盖多轮对话、任务规划、⼯具调⽤、上下⽂管理、记忆、知识库检索及异常恢复等场景。\n4. 评估 Agent 输出的准确性、相关性、一致性、可解释性和任务完成率,识别幻觉、指令偏离及不稳定输出。\n5. 建设 Agent 测试数据集和评测体系,设计正常、边界、对抗及复杂任务用例,⽀持版本间效果对比。\n6. 推进接口和端到端自动化测试,持续完善测试工具、测试平台及 CI/CD 质量门禁。\n7. 定位和分析线上问题,与产品、研发及算法团队协作推动缺陷修复和质量改进。\n8. 跟踪大模型及 Agent 技术发展,探索更高效的自动化评测和质量保障方案。",
        "requirements_text": "1. 本科及以上学历,计算机、软件工程、人工智能等相关专业优先。\n2. 具备 3 年以上软件测试经验,有完整项目测试和上线质量保障经验。\n3. 熟悉测试理论、测试流程和常用用例设计方法,具备较强的缺陷分析与问题定位能力。\n4. 熟悉 HTTP、RESTful API、WebSocket 等基础协议,能够使用接口测试及抓包工具。\n5. 掌握 Python、Java或 JavaScript 中至少一种编程语言,具备自动化测试脚本开发能力。\n6. 熟悉常见自动化测试框架,具备接口、Web UI 或端到端自动化测试经验。\n7. 了解大语言模型和 AI Agent 的基本原理,包括 Prompt、上下文窗口、RAG、工具调用、记忆及工作流等概念。\n8. 能够针对大模型输出的不确定性设计有效的评测指标和测试策略。\n9. 具备良好的沟通协作能力、质量意识和逻辑分析能力,能够主动推动问题闭环。",
        "skills": [AI生成
            "需求调研与需求分析",
            "产品方案与功能设计",
            "Agent系统构建",
            "Prompt工程",
            "RAG与检索增强",
            "Workflow与任务编排",
            "工具调用/MCP",
            "上下文/知识工程",
            "模型/Agent评测体系",
            "数据分析与指标体系",
            "部署上线与环境配置",
            "调试排障与技术支持",
            "实施交付与验收",
            "编程与代码实现",
            "Linux/DevOps/CI-CD",
            "跨部门/跨团队协作",
            "软件测试与质量工程"
        ],
        "preferred_qualifications": "- 有大模型、智能客服、AI 助手、RAG 或 Agent 产品测试经验。\n- 有 Agent 自动化评测平台、评测数据集或质量指标体系建设经验。\n- 熟悉模型评测指标,如任务完成率、准确率、召回率、幻觉率、工具调用成功率及响应延迟等。\n- 有性能测试、稳定性测试、安全测试或红队测试经验。\n- 熟悉 Docker、Linux、Git、CI/CD,并具备测试环境搭建和问题排查能力。\n- 了解主流大模型应用开发或观测评估平台。",
        "job_highlights": "1-3年 | 本科"
    },
    "contact": {
        "recruiter_name": "王先生",
        "contact_methods": [
            {
                "type": "apply_link",
                "value": "https://www.zhipin.com/job_detail/e7a672a0c6c20aa20nJ82Nm8F1RY.html"
            }
        ]
    },
    "posting": {
        "posting_id": "e7a672a0c6c20aa20nJ82Nm8F1RY",
        "post_date": "",
        "hire_time": "",
        "update_date": "",
        "job_url": "https://www.zhipin.com/job_detail/e7a672a0c6c20aa20nJ82Nm8F1RY.html"
    },
    "fulltext": "岗位职责\n1. 负责 Web、服务端及相关业务系统的测试工作,包括需求分析、测试方案设计、测试用例编写、测试执行和缺陷跟踪。\n2. 开展功能、接口、兼容性、性能、稳定性、安全性及回归测试,保障产品交付质量。\n3. 负责 AI Agent 产品的专项测试,覆盖多轮对话、任务规划、⼯具调⽤、上下⽂管理、记忆、知识库检索及异常恢复等场景。\n4. 评估 Agent 输出的准确性、相关性、一致性、可解释性和任务完成率,识别幻觉、指令偏离及不稳定输出。\n5. 建设 Agent 测试数据集和评测体系,设计正常、边界、对抗及复杂任务用例,⽀持版本间效果对比。\n6. 推进接口和端到端自动化测试,持续完善测试工具、测试平台及 CI/CD 质量门禁。\n7. 定位和分析线上问题,与产品、研发及算法团队协作推动缺陷修复和质量改进。\n8. 跟踪大模型及 Agent 技术发展,探索更高效的自动化评测和质量保障方案。\n任职要求\n1. 本科及以上学历,计算机、软件工程、人工智能等相关专业优先。\n2. 具备 3 年以上软件测试经验,有完整项目测试和上线质量保障经验。\n3. 熟悉测试理论、测试流程和常用用例设计方法,具备较强的缺陷分析与问题定位能力。\n4. 熟悉 HTTP、RESTful API、WebSocket 等基础协议,能够使用接口测试及抓包工具。\n5. 掌握 Python、Java或 JavaScript 中至少一种编程语言,具备自动化测试脚本开发能力。\n6. 熟悉常见自动化测试框架,具备接口、Web UI 或端到端自动化测试经验。\n7. 了解大语言模型和 AI Agent 的基本原理,包括 Prompt、上下文窗口、RAG、工具调用、记忆及工作流等概念。\n8. 能够针对大模型输出的不确定性设计有效的评测指标和测试策略。\n9. 具备良好的沟通协作能力、质量意识和逻辑分析能力,能够主动推动问题闭环。\n加分项\n- 有大模型、智能客服、AI 助手、RAG 或 Agent 产品测试经验。\n- 有 Agent 自动化评测平台、评测数据集或质量指标体系建设经验。\n- 熟悉模型评测指标,如任务完成率、准确率、召回率、幻觉率、工具调用成功率及响应延迟等。\n- 有性能测试、稳定性测试、安全测试或红队测试经验。\n- 熟悉 Docker、Linux、Git、CI/CD,并具备测试环境搭建和问题排查能力。\n- 了解主流大模型应用开发或观测评估平台。"
}