Alignment

Environments that probe and train model character: honesty under pressure, resistance to reward hacking, sycophancy, deception, and safe tool use. Rather than maximizing capability, these environments generate signal on whether models behave well when no one is watching.

6 startups

NameDomainsLocationTeamFundingRaising
Andon Labs
Long-horizon autonomy benchmarks like Vending-Bench
Long Horizon, AlignmentSan Francisco1-10Seed (Y Combinator)-
dmodel
Alignment-oriented environments focused on reward quality
Machine Learning, AlignmentSan Francisco11-25--
Gray Swan AI
Adversarial red-teaming arenas and safety evals for frontier models
Cybersecurity, AlignmentPittsburgh11-25~$40M (reported)-
Invariant Labs
Security testing and analysis for AI agents; acquired by Snyk
Cybersecurity, AlignmentZurich1-10Acquired by Snyk (June 2025)No
SynthLabs
Post-training research: synthetic data and scalable RL alignment
Machine Learning, Alignment, RLHFSan Francisco1-10Seed (M12 and First Spark Ventures, 2024)-
Trajectory Labs
Alignment-focused environments for safe agent trajectories
AlignmentBerkeley, Toronto1-10--

Other domains