How we made scalable long-horizon RL environments for Browser Use
OpenAI researchers developed scalable long-horizon reinforcement learning environments for browser use from real user traffic, filtering several hundred million task submissions down to about ten million distinct tasks a…