CareerPlanSign in

微信基础-大模型评测产品经理

Guangzhou, China💼 Full-time🗓 2026-09-28

Core

Design and manage the evaluation system for AI products, defining metrics, standards, and processes to ensure scientific rigor and comprehensive coverage across various scenarios.

Role type

Product Manager (AI Evaluation)

Builds

Evaluation platforms, evaluation frameworks, and data-driven optimization reports for AI products.

Domain

Artificial Intelligence / Large Language Models (LLM) / NLP

Deliverable

production ML models

Required skills

AI/NLP/Dialogue system evaluation experience, statistical significance testing, A/B test design, product requirement documentation (PRD), data analysis, multi-modal evaluation methods, annotation system design, competitor benchmarking.

Preferred skills

Experience building evaluation systems from 0 to 1, LLM/AI Agent product expertise, team management for annotation or crowdsourcing.

Responsibilities

Design evaluation systems and methodologies for different AI scenarios, plan evaluation platform architecture and features, analyze evaluation data to drive product and algorithm optimization, track competitor capabilities, and manage annotation standards and quality control.

Seniority

Mid-Senior, hands-on IC

Sourced via tencent · Listed on CareerPlan, which tracks 854,000+ jobs from 20+ sources.