AI Evaluator - Flexible Hours
Core
Evaluate generative AI models and LLMs by rating outputs, labeling content, creating training data, and generating prompts to improve AI reasoning and language capabilities.
Role type
Generative AI Evaluator (SME on Demand)
Builds
Training datasets and evaluation frameworks for Generative AI and LLMs
Domain
Artificial Intelligence / Generative AI
Deliverable
production ML models
Required skills
Rating AI model performance, content labeling, data transformation (text/image/audio), prompt engineering, content summarization, translation, transcription, data compilation
Preferred skills
Advanced degrees in humanities, expert English proficiency
Technologies
Large Language Models (LLMs), Generative AI systems
Responsibilities
Rate AI model outputs against specific criteria, label content elements, create training data via text/image/audio transformations, generate prompts for AI systems, evaluate content relevance and quality, rewrite text for clarity, summarize data, transcribe audio, translate languages, compile diverse digital content
Seniority
Individual Contributor, flexible hours