This was part of
New Horizons on Model Transportability and Data Integration
Variance Reduction and Adaptive Sampling in Reinforcement Learning with Verifiable Rewards
Tong Zhang, University of Illinois Urbana-Champaign
Tuesday, June 23, 2026