Publication Hybrid Combinatorial Multi-armed Bandits with Probabilistically Triggered Arms Kongchang Zhou, Tingyu Zhang, Wei Chen, Fang Kong Transactions on Machine Learning Research (TMLR) | June 2026
Publication The Fair Lending Model: How the Longest-Running Algorithmic Fairness Programs Work in Practice Emily Black, Miranda Bogen, L. Koepke, Solon Barocas, Wesley Deng, Ming‐Wei Hsu June 2026 arXiv | June 2026
Publication On the Complexity of Correlated Equilibria Beyond Normal-Form Games Ioannis Anagnostides, Constantinos Daskalakis, Gabriele Farina, Noah Golowich, Tuomas Sandholm, Brian Hu Zhang May 2026 arXiv | May 2026
Publication Near-optimal Online Traffic Engineering Arvin Ghavidel, Pooria Namyar, Nikolai Matni, W. Willinger, Ramesh Govindan May 2026 arXiv | May 2026
Publication Beyond GRPO and On-Policy Distillation: An Empirical Sparse-to-Dense Reward Principle for Language-Model Post-Training Yuan Xu, Hejian Sang, Zhengze Zhou, Ran He, Zhipeng Wang, A. Geramifard May 2026 arXiv | May 2026
Publication Language Modeling with Hyperspherical Flows Justin Deschenaux, Caglar Gulcehre May 2026 arXiv | May 2026
Publication Online Steiner Forest with Recourse Yaowei Long, Sepideh Mahabadi, Sherry Sarkar, Jakub Tarnawski ICALP 2026 | May 2026
Publication Can Revealed Preferences Clarify LLM Alignment and Steering? K. Yamin, Jingjing Tang, Eric Horvitz, Bryan Wilder May 2026 arXiv | May 2026
Publication Abductive Reasoning with Probabilistic Commonsense Joseph Cotnareanu, Chiara Roverato, Hang Zhou, Didier Chételat, Yingxue Zhang, Mark Coates May 2026 arXiv | May 2026
Publication Agentic-imodels: Evolving agentic interpretability tools via autoresearch Chandan Singh, Yuting Tan, Weijia Xu, Zelalem Gero, Weiwei Yang, Michel Galley, Jianfeng Gao May 2026 arXiv | May 2026