This was part of
Frontiers in Online Reinforcement Learning
“From CoT to Collaborative Inference: Efficient Inference via Collaborative Reasoning”
Ayush Sekhari, MIT
Tuesday, March 31, 2026