Publications
Selected Publications
Reasoning Cache: Continual Improvement Over Long Horizons via Short-Horizon RL
Ian Wu, Yuxiao Qu, Amrith Setlur, Aviral Kumar
ICML 2026
ICLR 2026 Workshop on Scaling Post-training for LLMs (Oral)
Paper
InT: Self-Proposed Interventions Enable Credit Assignment in LLM Reasoning
Matthew YR Yang, Hao Bai, Ian Wu, Gene Yang, Amrith Setlur, Aviral Kumar
ICLR 2026
Paper
Scaling Evaluation-time Compute with Reasoning Models as Process Evaluators
Seungone Kim*, Ian Wu*, Jinu Lee*, Xiang Yue, Seongyun Lee, Mingyeong Moon, Kiril Gashteovski, Carolin Lawrence, Julia Hockenmaier, Graham Neubig, Sean Welleck
ACL 2026 Findings
Paper
Better Instruction-Following through Minimum Bayes Risk
Ian Wu, Patrick Fernandes, Amanda Bertsch, Seungone Kim, Sina Pakazad, Graham Neubig
ICLR 2025 (Spotlight)
Paper
Synthetic Multimodal Question Generation
Ian Wu, Sravan Jayanthi, Vijay Viswanathan, Simon Rosenberg, Sina Pakazad, Tongshuang Wu, Graham Neubig
EMNLP 2024 Findings
Paper
