Publication Optimal Kinodynamic Motion Planning Through Anytime Bidirectional Heuristic Search with Tight Termination Condition Yi Wang, Bingxian Mu, Shahab Shokouhi, May-Win L. Thein April 2026 arXiv | April 2026
Publication UniPROT: Uniform Prototype Selection via Partial Optimal Transport with Submodular Guarantees Prateek Chanda, Prayas Agrawal, Karthik S. Gurumoorthy, Ganesh Ramakrishnan, Bamdev Mishra, Pratik Jawanpuria April 2026 arXiv | April 2026
Publication M$^star$: Every Task Deserves Its Own Memory Harness Wenbo Pan, Shujie Liu, Xiangyang Zhou, Shiwei Zhang, Wanlu Shi, Mirror Xu, Xiaohua Jia April 2026 arXiv | April 2026
Publication SPPO: Sequence-Level PPO for Long-Horizon Reasoning Tasks Tianyi Wang, Yixia Li, Long Li, Yibiao Chen, Shaohan Huang, Yun Chen, Peng Li, Yang Liu, Guanhua Chen April 2026 arXiv | April 2026
Publication MEMENTO: Teaching LLMs to Manage Their Own Context Vasilis Kontonis, Yuchen Zeng, Shivam Garg, Lingjiao Chen, Hao Tang, Ziyan Wang, Ahmed Awadallah, Eric Horvitz, John Langford, Dimitris Papailiopoulos April 2026 arXiv | April 2026
Publication When Equality Fails as a Rewrite Principle: Provenance and Definedness for Measurement-Bearing Expressions David B. Hulak, A. Ramos, Ruy J. G. B. de Queiroz April 2026 arXiv | April 2026
Publication RAGEN-2: Reasoning Collapse in Agentic RL Zihan Wang, Chi Gui, Xing Jin, Qineng Wang, Licheng Liu, Kangrui Wang, Shiqi Chen, Linjie Li, Zhengyuan Yang, Pingyue Zhang, Yiping Lu, Jiajun Wu, Fei-Fei Li, Lijuan Wang, Yejin Choi, Manling Li ICML 2026 | April 2026
Publication VERT: Reliable LLM Judges for Radiology Report Evaluation Federica Bologna, Jean-Philippe Corbeil, Matthew Wilkens, Asma Ben Abacha April 2026 arXiv | April 2026
Publication Combinatorial Rising Bandits Seockbean Song, Youngsik Yoon, Siwei Wang, Wei Chen, Jungseul Ok The 14th International Conference on Learning Representations (ICLR) | April 2026
Publication Lipschitz Bandits with Stochastic Delayed Feedback Zhongxuan Liu, Yue Kang, Thomas C. M. Lee ICLR 2026 | April 2026