Enterprise Workflows: RL environments and AI benchmarks

24 environments · 7 benchmarks · snapshot 2026-09-03

Scroll to zoom · drag to pan · ○ environment · ◇ benchmark · ● domain

RL environments 24

  1. AfterQuery rl-list
  2. Mercor rl-list
  3. Prime Intellect rl-list
  4. Surge AI rl-list
  5. Deeptune rl-list
  6. Sepal AI rl-list
  7. Turing rl-list
  8. Fleet AI rl-list
  9. Scale AI rl-list
  10. Fleet pavlovslist
  11. Halluminate rl-list
  12. BenchFlow rl-list
  13. HUD rl-list
  14. Huzzle Labs rl-list
  15. Collinear rl-list
  16. Veris AI rl-list
  17. Plato rl-list
  18. AIChamp rl-list
  19. Habitat Inc rl-list
  20. Aptura pavlovslist
  21. Metaphi pavlovslist
  22. Akhara pavlovslist
  23. Ooak Data pavlovslist
  24. Theta pavlovslist

AI benchmarks 7

  1. Terminal-Bench / Terminal-Bench 2.0 AfterQuery · rl-list
  2. OSWorld-Verified HUD · rl-list
  3. FinanceQA AfterQuery · rl-list
  4. IDE-Bench AfterQuery · rl-list
  5. EnterpriseBench CoreCraft Surge AI · rl-list
  6. APEX Mercor · rl-list
  7. APEX-Agents Mercor · rl-list

Next: pick another domain. Tags come from the RL Engineering daily scrape, canonicalized nightly.