Publications
2026
- AREAL-DTA: Dynamic Tree Attention for Efficient Reinforcement Learning of Large Language Models2026
2025
- AReaL-Hex: Accommodating Asynchronous RL Training over Heterogeneous GPUs2025
-
How Far Are We from Optimal Reasoning Efficiency?Aug 2025
2024
-
On Designing Effective RL Reward at Training Time for LLM ReasoningMay 2024 -