RL Environment
RL Environments and Agents
Custom RL environments and verifier design for training and evaluating agentic models.
Surge · 100% completeCompany-reported
Expert demonstrations for bootstrapping model capabilities, including computer and browser use.
Surge describes supervised fine-tuning demonstrations that teach models foundational skills such as computer use, web navigation, and reasoning.
Only evidenced capabilities are shown as Yes. Missing evidence remains Unknown.
Custom RL environments and verifier design for training and evaluating agentic models.
Custom rubric and verifier design for scoring complex model and agent behavior.
Human preference and reward data for reinforcement learning from human feedback.