HumanSourcer

AI model evaluation roles

514 open ai model evaluation roles are currently listed across 15 AI-training networks.

Evaluating AI model outputs, authoring test tasks, or reviewing model responses to identify errors, weaknesses, and failure modes.

24 of 24 roles
Ara Zeta Project - AI Safety Evaluator - Tamil (Singapore)
Welo Data· AI model evaluation· Region specific
Czech AI Ads Reviewer
Welo Data· AI model evaluation· Region specific
Dutch Advertisement Reviewer (Suriname)
Welo Data· AI model evaluation· Region specific
Entry-Level AI Data Rater - Dutch
Welo Data· AI model evaluation· Region specific
Entry-Level AI Data Rater - Swedish (Bulgaria)
Welo Data· AI model evaluation· Region specific
Entry-Level AI Data Rater - Swedish (Estonia)
Welo Data· AI model evaluation· Region specific
Entry-Level AI Data Rater - Swedish (Latvia)
Welo Data· AI model evaluation· Region specific
Entry-Level AI Data Rater - Swedish (Poland)
Welo Data· AI model evaluation· Region specific
Entry-Level AI Data Rater - Swedish (Romania)
Welo Data· AI model evaluation· Region specific
Entry-Level AI Data Rater - Swedish (Sweden)
Welo Data· AI model evaluation· Region specific
Expert Rater Project - Dutch (Netherlands)
Welo Data· AI model evaluation· Region specific
Expert Rater Project - Dutch (Spain)
Welo Data· AI model evaluation· Region specific
Expert Rater Project - English (India)
Welo Data· AI model evaluation· Region specific
Expert Rater Project - English (US)
Welo Data· AI model evaluation· United States
Expert Rater Project - French
Welo Data· AI model evaluation· Region specific
Expert Rater Project - German
Welo Data· AI model evaluation· Region specific
Expert Rater Project - Italian
Welo Data· AI model evaluation· Region specific
Expert Rater Project - Japanese
Welo Data· AI model evaluation· Region specific
Expert Rater Project - Portuguese
Welo Data· AI model evaluation· Region specific
Expert Rater Project - Spanish
Welo Data· AI model evaluation· Region specific
German Advertising Reviewer
Welo Data· AI model evaluation· Region specific
Korean Speaker Lyric Reviewer
Welo Data· AI model evaluation· Region specific
Maps Personalization Relevance Rater - English (Australia)
Welo Data· AI model evaluation· Region specific
Maps Personalization Relevance Rater - English (Canada)
Welo Data· AI model evaluation· Region specific

Frequently asked questions

What is AI model evaluation work?

Evaluating AI model outputs, authoring test tasks, or reviewing model responses to identify errors, weaknesses, and failure modes.

How many AI model evaluation roles are currently open?

514 open ai model evaluation roles are currently listed across HumanSourcer's tracked networks. This count updates daily.

Which companies need AI model evaluation workers?

Currently: AfterQuery Experts, Alignerr, DataForce jobs, G2i Talent, Handshake AI, Meridial, and 9 more.

What does AI model evaluation work pay?

Where pay is disclosed, the most common range is $40+/hr (31 of 514 roles). 465 of 514 listings don't publicly disclose pay.

Is AI model evaluation work remote?

Location varies by role — the most common listing type is "Region specific" (268 of 514 roles).