CareerPlanSign in

AI模型评估及训练实习生(J79823)

北京市💼 Full-time🗓 2026-07-21 → 2026-09-28

Core

Design scalable evaluation schemes for large language models (LLMs) focused on Q&A scenarios, generate assessment data and reports to drive model iteration, and establish SOPs for SFT/RM supervised data production.

Role type

Intern, LLM evaluation and data strategy

Builds

Evaluation metrics, assessment reports, and supervised datasets (SFT/RM) for model iteration

Domain

Artificial Intelligence / Large Language Models

Deliverable

production ML models

Required skills

LLM principles, Q&A content quality assessment, SFT/RM data production, team management, SOP creation

Preferred skills

Experience managing 20+ person annotation/evaluation teams, strong communication skills

Technologies

LLMs, SFT, RM

Sourced via baidu · Listed on CareerPlan, which tracks 845,000+ jobs from 20+ sources.