AI模型评估及训练实习生(J79823)
Core
Design scalable evaluation schemes for large language models (LLMs) focused on Q&A scenarios, generate assessment data and reports to drive model iteration, and establish SOPs for SFT/RM supervised data production.
Role type
Intern, LLM evaluation and data strategy
Builds
Evaluation metrics, assessment reports, and supervised datasets (SFT/RM) for model iteration
Domain
Artificial Intelligence / Large Language Models
Deliverable
production ML models
Required skills
LLM principles, Q&A content quality assessment, SFT/RM data production, team management, SOP creation
Preferred skills
Experience managing 20+ person annotation/evaluation teams, strong communication skills
Technologies
LLMs, SFT, RM
Sourced via baidu · Listed on CareerPlan, which tracks 845,000+ jobs from 20+ sources.
