Publications

Selected Publications

Reasoning Cache: Continual Improvement Over Long Horizons via Short-Horizon RL
Ian Wu, Yuxiao Qu, Amrith Setlur, Aviral Kumar
ICML 2026
ICLR 2026 Workshop on Scaling Post-training for LLMs (Oral)
Paper

InT: Self-Proposed Interventions Enable Credit Assignment in LLM Reasoning
Matthew YR Yang, Hao Bai, Ian Wu, Gene Yang, Amrith Setlur, Aviral Kumar
ICLR 2026
Paper

Scaling Evaluation-time Compute with Reasoning Models as Process Evaluators
Seungone Kim*, Ian Wu*, Jinu Lee*, Xiang Yue, Seongyun Lee, Mingyeong Moon, Kiril Gashteovski, Carolin Lawrence, Julia Hockenmaier, Graham Neubig, Sean Welleck
ACL 2026 Findings
Paper

Better Instruction-Following through Minimum Bayes Risk
Ian Wu, Patrick Fernandes, Amanda Bertsch, Seungone Kim, Sina Pakazad, Graham Neubig
ICLR 2025 (Spotlight)
Paper

Synthetic Multimodal Question Generation
Ian Wu, Sravan Jayanthi, Vijay Viswanathan, Simon Rosenberg, Sina Pakazad, Tongshuang Wu, Graham Neubig
EMNLP 2024 Findings
Paper