JD数据
{
"schema_version": "via_ai_product_manager_jobs_v1",
"data_type": "ai_product_manager_jobs",
"job": {
"job_title": "通用Agent数据产品-北京/杭州(AI大厂)",
"job_level": "高级",AI生成
"work_category": "全职",AI生成
"department": "",
"location": "北京··",
"work_mode": "现场办公",AI生成
"job_category": "AI效果评测"AI生成
},
"company": {
"company_name": "某中型人工智能公司",
"company_industry": "人工智能",
"company_size": "100-499人",
"company_website": "",
"company_description": ""
},
"compensation": {
"salary_range": {
"min": 30000,
"max": 60000,
"currency": "元",
"cycle": "月"
},
"benefits": ""
},
"requirements": {
"working_years": "",
"degree": "本科",
"language": "中文",AI生成
"visa_support": "",
"responsibilities": "语义类AI\n大模型评测\n模型评测\n自动化评测\n评测体系\n工作流自动化\nLLM Agent\nLLM Evaluation\n定义并推进大模型在真实任务场景中的 Agent 能力,深入办公与⽇常⽣活等场景下的复杂环境,使模型能⾃主规划、执行并交付完整结果,持续识别能力瓶颈,驱动模型迭代优化。\n围绕 AI 搜索及⾃主任务执行的全流程,设计并落地多维度自动化评测与归因体系,建立能真正区分“能用”与“好用”的评测标准,覆盖端到端任务完成度与过程行为质量,打通人工评估与自动化评估,精准定位模型短板。\n针对各类 AI 搜索与 Agent 任务,定义回答及执行结果的理想态,设计并迭代高质量、高多样性的数据生产管线,系统性提升搜索回答与 Agent 产物的准确性、完整性和用户体验。",
"requirements_text": "拥有主流 AI 搜索及 Agent 产品的深度使用经验,熟悉当前主流 Agent 架构与产品形态,能够敏锐感知模型能力差异,定位背后的数据需求与问题。\n对任务质量有清晰的判断标准与内在追求,对“好”有明确的界定能力,能精准辨识输出质量的层级差异,并能将主观感受拆解为可传达、可检验的具体维度。\n理解模型训练与优化的基本原理,熟悉模型评测方法,精通 prompt engineering 和(vibe)coding;动手能力强,有丰富的使用自动化手段解决真实问题的经验。\n对 AI Agent 领域有真实的热情,持续关注前沿进展,对 AI 能力的边界保持探索欲与想象力。相信 Agent 终将深度改变人机协作的方式,让工作更高效,让创造更自由。\n有以下经验者优先:Agent 产品深度使用或构建、自动化工作流设计、评测体系搭建或大模型数据构造经验。\n认证资质\n人力资源服务许可证",
"skills": [AI生成
"用户研究与体验优化",
"大模型原理与能力边界",
"Agent系统构建",
"Prompt工程",
"Workflow与任务编排",
"模型训练与算法优化",
"模型/Agent评测体系",
"训练数据/标注/合成"
],
"preferred_qualifications": "",
"job_highlights": "经验不限 | 本科"
},
"contact": {
"recruiter_name": "黄先生",
"contact_methods": [
{
"type": "apply_link",
"value": "https://www.zhipin.com/job_detail/418c4f62f42da89f0nF-29S8FVFQ.html"
}
]
},
"posting": {
"posting_id": "418c4f62f42da89f0nF-29S8FVFQ",
"post_date": "",
"hire_time": "",
"update_date": "",
"job_url": "https://www.zhipin.com/job_detail/418c4f62f42da89f0nF-29S8FVFQ.html"
},
"fulltext": "语义类AI\n大模型评测\n模型评测\n自动化评测\n评测体系\n工作流自动化\nLLM Agent\nLLM Evaluation\n【工作职责】\n定义并推进大模型在真实任务场景中的 Agent 能力,深入办公与⽇常⽣活等场景下的复杂环境,使模型能⾃主规划、执行并交付完整结果,持续识别能力瓶颈,驱动模型迭代优化。\n围绕 AI 搜索及⾃主任务执行的全流程,设计并落地多维度自动化评测与归因体系,建立能真正区分“能用”与“好用”的评测标准,覆盖端到端任务完成度与过程行为质量,打通人工评估与自动化评估,精准定位模型短板。\n针对各类 AI 搜索与 Agent 任务,定义回答及执行结果的理想态,设计并迭代高质量、高多样性的数据生产管线,系统性提升搜索回答与 Agent 产物的准确性、完整性和用户体验。\n【岗位要求】\n拥有主流 AI 搜索及 Agent 产品的深度使用经验,熟悉当前主流 Agent 架构与产品形态,能够敏锐感知模型能力差异,定位背后的数据需求与问题。\n对任务质量有清晰的判断标准与内在追求,对“好”有明确的界定能力,能精准辨识输出质量的层级差异,并能将主观感受拆解为可传达、可检验的具体维度。\n理解模型训练与优化的基本原理,熟悉模型评测方法,精通 prompt engineering 和(vibe)coding;动手能力强,有丰富的使用自动化手段解决真实问题的经验。\n对 AI Agent 领域有真实的热情,持续关注前沿进展,对 AI 能力的边界保持探索欲与想象力。相信 Agent 终将深度改变人机协作的方式,让工作更高效,让创造更自由。\n有以下经验者优先:Agent 产品深度使用或构建、自动化工作流设计、评测体系搭建或大模型数据构造经验。\n认证资质\n人力资源服务许可证"
}