RL Environment
RL Environments and Agents
Custom RL environments and verifier design for training and evaluating agentic models.
Surge · 100% completeCompany-reported
An expert-authored benchmark of economically valuable tasks in finance, consulting, law, and medicine.
The AI Productivity Index assesses model performance on professional work across investment banking, management consulting, law, and primary care. Mercor provides public research, data, code, and sample-task links.
Only evidenced capabilities are shown as Yes. Missing evidence remains Unknown.
Custom RL environments and verifier design for training and evaluating agentic models.
Expert-authored data and judgment across professional, STEM, and humanities domains.
Pre-built commercial datasets and RL environments spanning coding, enterprise agents, STEM, tool use, and reasoning.