Long-Horizon: RL environments and AI benchmarks

22 environments · 3 benchmarks · snapshot 2026-09-03

Scroll to zoom · drag to pan · ○ environment · ◇ benchmark · ● domain

RL environments 22

  1. Mercor rl-list
  2. Prime Intellect rl-list
  3. Surge AI rl-list
  4. Sepal AI rl-list
  5. Scale AI rl-list
  6. Bespoke Labs rl-list
  7. Andon Labs rl-list
  8. General Reasoning rl-list
  9. Good Start Labs rl-list
  10. Vmax rl-list
  11. Proximal rl-list
  12. Huzzle Labs rl-list
  13. Collinear rl-list
  14. Andromede rl-list
  15. AIChamp rl-list
  16. EdotEnv pavlovslist
  17. pre.dev pavlovslist
  18. Tacit Labs pavlovslist
  19. Parsewave pavlovslist
  20. ARIMLABS pavlovslist
  21. Anthromind pavlovslist
  22. Diffuse Labs pavlovslist

AI benchmarks 3

  1. EnterpriseBench CoreCraft Surge AI · rl-list
  2. APEX Mercor · rl-list
  3. APEX-Agents Mercor · rl-list

Next: pick another domain. Tags come from the RL Engineering daily scrape, canonicalized nightly.