Senior Software Engineer, AI Training - AU
Core
Evaluate the quality of interactions with modern AI coding agents (e.g., OpenAI Codex, Claude Code) to assess engineering judgment and reasoning.
Role type
Senior AI Training Evaluator
Builds
Evaluation datasets and feedback loops for AI coding agents
Domain
Artificial Intelligence / Software Development
Deliverable
production ML models
Required skills
TypeScript/JavaScript, Python, AI coding agents (Codex/Claude/Cursor), code evaluation without execution, written English (B2+), video communication
Preferred skills
Prompt design, evaluation workflows, mentoring senior engineers
Technologies
OpenAI Codex, Claude Code, Cursor
Responsibilities
Evaluate AI-generated coding interactions end to end, judge output usefulness and alignment with strong engineering practices, assess quality of explanations and reasoning, distinguish response quality levels, provide clear written and video feedback, help define standards for great AI interactions



