This was part of New Horizons on Model Transportability and Data Integration

Variance Reduction and Adaptive Sampling in Reinforcement Learning with Verifiable Rewards

Tong Zhang, University of Illinois Urbana-Champaign

Tuesday, June 23, 2026



Slides