HumanSourcer

AI model evaluation roles

514 open ai model evaluation roles are currently listed across 15 AI-training networks.

Evaluating AI model outputs, authoring test tasks, or reviewing model responses to identify errors, weaknesses, and failure modes.

24 of 24 roles
Medical Assistant - AI Safety Benchmark
Sepal Expert Hub· AI model evaluation· Global
Evaluator/Reviewer - Paralegals & Legal Assistants
Sepal Expert Hub· AI model evaluation· Global
SAP Solutions Professional - AI Benchmark
Sepal Expert Hub· AI model evaluation· Global
Evaluator/Reviewer - English Language & Literature Teachers, Postsecondary
Sepal Expert Hub· AI model evaluation· Global
Senior Software Code Reviewer
$40-300/deliverable
Vetto Opportunities· AI model evaluation· Global
Legal Expert - Reviewer
$50-60/h
Vetto Opportunities· AI model evaluation· Global
Personal Account Rater -German
Turing AI Advancement Work· AI model evaluation· Remote
*Scout Search Quality Rater - Japanese | ウェブ検索結果品質評価者【在宅/フリーランス/英語を活かせる】 (日本在住の方)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Bengali (India)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Bulgarian (Bulgaria)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Cantonese (Hong Kong)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Catalan (Spain)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Croatian (Croatia)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Czech (Slovakia)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Dutch (Belgium)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Dutch (France)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Dutch (Netherlands)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Farsi (Turkey)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Filipino (Philippines)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Finnish (Finland)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - German (Brazil)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - German (Germany)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Hebrew (Israel)
Welo Data· AI model evaluation· Region specific
Ads Quality Rater - Hungarian (Hungary)
Welo Data· AI model evaluation· Region specific

Frequently asked questions

What is AI model evaluation work?

Evaluating AI model outputs, authoring test tasks, or reviewing model responses to identify errors, weaknesses, and failure modes.

How many AI model evaluation roles are currently open?

514 open ai model evaluation roles are currently listed across HumanSourcer's tracked networks. This count updates daily.

Which companies need AI model evaluation workers?

Currently: AfterQuery Experts, Alignerr, DataForce jobs, G2i Talent, Handshake AI, Meridial, and 9 more.

What does AI model evaluation work pay?

Where pay is disclosed, the most common range is $40+/hr (31 of 514 roles). 465 of 514 listings don't publicly disclose pay.

Is AI model evaluation work remote?

Location varies by role — the most common listing type is "Region specific" (268 of 514 roles).