RAGEN - An open-source reinforcement learning framework for training large-scale model inference agents.
RAGEN is an open-source reinforcement learning framework for training large language model (LLM) inference agents in interactive, stochastic environments. It is based on StarPO (State-Thinking-Action-Reward Policy Optimization)...