Explore AI training careers
21 roles across 15 specialisms. Sign in to see which of them match your background.
AI Response Evaluator
Review and rate AI-generated responses against quality, accuracy and safety guidelines.
AI Response Quality Analyst
Analyse patterns in AI response quality and report systematic failure modes.
AI Prompt Evaluator
Assess prompt clarity, intent coverage and how well prompts elicit correct model behaviour.
Prompt Engineer
Design, test and refine prompts and prompt systems for reliable model outputs.
AI Trainer
Produce and correct training examples that teach models desired behaviour.
Data Annotator
Label text and structured data accurately against detailed annotation guidelines.
Image Annotator
Label, segment and bound objects in images for computer vision training data.
Video Annotator
Annotate objects, actions and events across video frames and timelines.
Voice Annotator
Transcribe and label speech data including speaker, intent and quality attributes.
Audio Annotator
Label non-speech audio events, acoustic scenes and audio quality attributes.
Preference Ranking Specialist
Compare and rank model outputs to produce human preference data for alignment.
LLM Evaluator
Evaluate large language model outputs across reasoning, factuality and instruction following.
AI Content Evaluator
Evaluate AI-generated content for quality, originality, tone and policy compliance.
Search Quality Evaluator
Rate search and recommendation results against relevance and usefulness guidelines.
AI Safety Evaluator
Identify harmful, unsafe or policy-violating model behaviour and red-team models.
Multimodal AI Evaluator
Evaluate model performance across combined text, image, audio and video inputs.
Domain Expert AI Trainer
Apply professional domain expertise to train and evaluate models in a specialist field.
AI Writing Evaluator
Assess AI writing for style, structure, coherence and factual grounding.
AI Coding Evaluator
Review AI-generated code for correctness, efficiency, security and maintainability.
AI Reasoning Evaluator
Evaluate step-by-step reasoning chains for logical validity and correctness.
Data Quality Analyst
Audit annotation quality, measure agreement and drive dataset improvements.