AI Tutor - Humanities
Core
Evaluate AI model outputs in humanities fields for factual accuracy, logical coherence, and hidden assumptions; create high-quality training data and reference answers to improve Grok's reasoning and communication in areas like history, philosophy, and literature.
Role type
Senior AI Humanities Specialist (Data Annotation & Evaluation)
Builds
Training datasets and evaluation rubrics for the Grok AI model
Domain
Artificial Intelligence / Humanities (History, Philosophy, Linguistics, etc.)
Deliverable
production ML models
Required skills
Deep knowledge in humanities fields (linguistics, history, classical studies, literature, poetry, philosophy, ethics, visual arts, performing arts), argument validity assessment, primary source analysis, steel-man opposing views, analytical writing in English, adapting to evolving instructions
Preferred skills
PhD in a listed field, published analytical work, experience in teaching or academic peer review, familiarity with LLM evaluation or benchmark building
Technologies
Grok (AI model)
Responsibilities
Evaluate model outputs for factual accuracy and logical coherence; Flag confident-sounding errors and ideological slants; Create exemplary responses grounded in primary sources; Collaborate with engineering teams to design evaluation tasks; Define good model behavior for contested humanistic questions
Seniority
Senior, hands-on IC