HumanSourcer

AI model evaluation roles

514 open ai model evaluation roles are currently listed across 15 AI-training networks.

Evaluating AI model outputs, authoring test tasks, or reviewing model responses to identify errors, weaknesses, and failure modes.

24 of 24 roles
Maps Personalization Relevance Rater - English (India)
Welo Data· AI model evaluation· Region specific
Maps Personalization Relevance Rater - English (UK)
Welo Data· AI model evaluation· Region specific
Maps Personalization Relevance Rater - English (US)
Welo Data· AI model evaluation· United States
Maps Personalization Relevance Rater - French (Canada)
Welo Data· AI model evaluation· Region specific
Maps Personalization Relevance Rater - Japanese (Japan)
Welo Data· AI model evaluation· Region specific
Maps Visual Design Relevance Evaluator - English (US)
Welo Data· AI model evaluation· United States
Maps Visual Design Relevance Rater - English (US)
Welo Data· AI model evaluation· United States
REFFERAL *Scout Search Quality Rater - Simplified Chinese (Canada)
Welo Data· AI model evaluation· Region specific
Remote Internet Search Quality Rater - English (United States)
Welo Data· AI model evaluation· United States
Gen AI Rater - STEM Domain
DataForce jobs· AI model evaluation· Remote
Legal Expert Reviewer & Quality Consultant
DataForce jobs· AI model evaluation· Remote
Internet Judging: Milky Way (Maps Evaluation)
OneForma· AI model evaluation· Region specific
Education Pronunciation Evaluation
OneForma· AI model evaluation· Region specific
Athena – AI Agent Reviewer
OneForma· AI model evaluation· Region specific
RedWing – User Experience Evaluation (Medical Domain)
OneForma· AI model evaluation· Region specific
Project Photo ML IQ 2 – Evaluate Image Quality and Help Improve Computer Vision AI
OneForma· AI model evaluation· Region specific
Project Harbor Red Teaming – Juno | Remote AI Safety Evaluation
OneForma· AI model evaluation· Region specific
Math & AI Evaluation Specialist- Intermediate (AI Community)
$10/hr
TELUS International AI Community portal· AI model evaluation· Remote
Cultural Safety & Red-Teaming Expert (AI Community)
$18/hr
TELUS International AI Community portal· AI model evaluation· Remote
GenAI Multilingual Specialist — LLM/VLM Evaluation & SFT Expert
$4.5/hr
TELUS International AI Community portal· AI model evaluation· Remote
Philosophy & Logic Reviewer - Intermediate (AI Community)
$10/hr
TELUS International AI Community portal· AI model evaluation· Remote
Cultural Safety & Red-Teaming Specialist - Intermediate (AI Community)
$10/hr
TELUS International AI Community portal· AI model evaluation· Remote
Math & AI Evaluation Expert (AI Community)
$18/hr
TELUS International AI Community portal· AI model evaluation· Remote
Image Evaluation Generalist
$20-30/hr
micro1 Experts Opportunities· AI model evaluation· Global

Frequently asked questions

What is AI model evaluation work?

Evaluating AI model outputs, authoring test tasks, or reviewing model responses to identify errors, weaknesses, and failure modes.

How many AI model evaluation roles are currently open?

514 open ai model evaluation roles are currently listed across HumanSourcer's tracked networks. This count updates daily.

Which companies need AI model evaluation workers?

Currently: AfterQuery Experts, Alignerr, DataForce jobs, G2i Talent, Handshake AI, Meridial, and 9 more.

What does AI model evaluation work pay?

Where pay is disclosed, the most common range is $40+/hr (31 of 514 roles). 465 of 514 listings don't publicly disclose pay.

Is AI model evaluation work remote?

Location varies by role — the most common listing type is "Region specific" (268 of 514 roles).