职位详情

职位列表 AI场景化产品规划 15c2b33a69f4d40c

AI大模型应用能力评估实习生

200-250元/天 · 北京·海淀区·苏州桥 · 字节跳动

JD数据
{
    "schema_version": "via_ai_product_manager_jobs_v1",
    "data_type": "ai_product_manager_jobs",
    "job": {
        "job_title": "AI大模型应用能力评估实习生",
        "job_level": "管培生",AI生成
        "work_category": "实习",AI生成
        "department": "",
        "location": "北京·海淀区·苏州桥",
        "work_mode": "现场办公",AI生成
        "job_category": "AI效果评测"AI生成
    },
    "company": {
        "company_name": "字节跳动",
        "company_industry": "互联网",
        "company_size": "10000人以上",
        "company_website": "",
        "company_description": "字节跳动成立于2012年3月,公司使命为“Inspire Creativity, Enrich Life(激发创造,丰富生活)”。公司业务覆盖150个国家和地区,拥有15万名员工。"
    },
    "compensation": {
        "salary_range": {
            "min": "",
            "max": "",
            "currency": "",
            "cycle": ""
        },
        "benefits": "定期体检 | 住房补贴 | 团建聚餐 | 就近租房补贴 | 补充医疗保险 | 家庭关爱假 | 五险一金 | 年终奖 | 免费健身设施 | 绩效奖金 | 年度体检 | 餐补 | 带薪年假 | 意外险 | 家属自选保险 | 股票期权"
    },
    "requirements": {
        "working_years": "",
        "degree": "本科",
        "language": "中文",AI生成
        "visa_support": "",
        "responsibilities": "1、参与AI大模型应用能力评估工作,围绕垂类业务场景(如Model Spec和商业化),根据业务⽬标拆解评估维度,协助设计评估集、评估标准与⾃动评估⼯具;\n2、参与设计和迭代自动评估Workflow,理解LLM as a Judge的基本思路,能结合规则校验、模型评分、抽样复核等方式提升评测效率,并协助完成模型选型、评估指标定义和模型效果对⽐分析;\n3、对模型输出进行评估、复核和问题归因,识别Badcase类型,沉淀模型能力短板和优化建议;\n4、结合真实业务链路构造复杂、多轮、边界型评测样本,关注模型在意图理解、信息准确性、风格一致性、任务完成度等方面的表现;\n5、与产品、算法、运营、数据等团队同学协作,跟进问题定位、需求推进和结果闭环。",
        "requirements_text": "1、日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会;\n2、本科及以上学历在读,计算机、人工智能、数据科学、统计学、信息管理、语言学、心理学、商科等相关专业优先;\n3、具备较强的结构化分析能力,能把抽象问题拆解成清晰的评估维度和可执行标准;\n4、沟通协作能力强,能主动对齐目标、同步进展、推动问题解决,具备较强的闭环意识,能对自己负责的任务从理解需求、执行交付到结果复盘完整跟进;\n5、灵活变通,面对需求或临时变化时,能快速理解背景、调整方案并推进落地。",
        "skills": [AI生成
            "业务理解与场景抽象",
            "大模型原理与能力边界",
            "Workflow与任务编排",
            "模型/Agent评测体系",
            "调试排障与技术支持",
            "项目推动与执行闭环",
            "结构化思考与系统抽象",
            "复杂问题分析与解决"
        ],
        "preferred_qualifications": "",
        "job_highlights": "5天/周 | 3个月 | 本科"
    },
    "contact": {
        "recruiter_name": "倪先生",
        "contact_methods": [
            {
                "type": "apply_link",
                "value": "https://www.zhipin.com/job_detail/10ae445b97f3ff2b0nJ_3Nq9EFJV.html"
            }
        ]
    },
    "posting": {
        "posting_id": "10ae445b97f3ff2b0nJ_3Nq9EFJV",
        "post_date": "",
        "hire_time": "",
        "update_date": "",
        "job_url": "https://www.zhipin.com/job_detail/10ae445b97f3ff2b0nJ_3Nq9EFJV.html"
    },
    "fulltext": "岗位职责:1、参与AI大模型应用能力评估工作,围绕垂类业务场景(如Model Spec和商业化),根据业务⽬标拆解评估维度,协助设计评估集、评估标准与⾃动评估⼯具;\n2、参与设计和迭代自动评估Workflow,理解LLM as a Judge的基本思路,能结合规则校验、模型评分、抽样复核等方式提升评测效率,并协助完成模型选型、评估指标定义和模型效果对⽐分析;\n3、对模型输出进行评估、复核和问题归因,识别Badcase类型,沉淀模型能力短板和优化建议;\n4、结合真实业务链路构造复杂、多轮、边界型评测样本,关注模型在意图理解、信息准确性、风格一致性、任务完成度等方面的表现;\n5、与产品、算法、运营、数据等团队同学协作,跟进问题定位、需求推进和结果闭环。\n任职要求:1、日常实习:面向全体在校生,为符合岗位要求的同学提供为期3个月及以上的项目实践机会;\n2、本科及以上学历在读,计算机、人工智能、数据科学、统计学、信息管理、语言学、心理学、商科等相关专业优先;\n3、具备较强的结构化分析能力,能把抽象问题拆解成清晰的评估维度和可执行标准;\n4、沟通协作能力强,能主动对齐目标、同步进展、推动问题解决,具备较强的闭环意识,能对自己负责的任务从理解需求、执行交付到结果复盘完整跟进;\n5、灵活变通,面对需求或临时变化时,能快速理解背景、调整方案并推进落地。"
}