Publication Generative Video Compression with One-Dimensional Latent Representation Zihan Zheng, Zhaoyang Jia, Naifu Xue, Jiahao Li, Bin Li, Zongyu Guo, Xiaoyi Zhang, Zhenghao Chen, Houqiang Li, Yan Lu March 2026 arXiv | March 2026
Publication Object Fusion via Diffusion Time-step for Customized Image Editing with Single Example Xue Song, Zhongqi Yue, Jiequan Cui, Hanwang Zhang, Jingjing Chen 2005 IEEE Computer Society Conference on Computer Vision and Pattern Recognition (CVPR’05) | March 2026, pp. 9127-9134
Publication Multi-Object Advertisement Creative Generation Jialu Gao, Mithun Gupta, Qun Li, Raveena Kshatriya, Andrew D. Wilson, Keng-hao Chang, Balasaravanan Thoravi Kumaravel March 2026 arXiv | March 2026
Publication InfoAlign: A Human-AI Co-Creation System for Storytelling with Infographics Jielin Feng, Xinwu Ye, Qianhui Li, Verena Prantl, Jun-Hsiang Yao, Yuheng Zhao, Yun Wang, Siming Chen CHI 2026 | February 2026
Publication FilMaster: Bridging Cinematic Principles and Generative AI for Automated Film Generation Kaiyi Huang, Yukun Huang, Xintao Wang, Zinan Lin, Xuefei Ning, Pengfei Wan, Di Zhang, Yu Wang, Xihui Liu ICLR 2026 | February 2026
Publication Long Video Understanding with Learnable Retrieval in Video-Language Models Jiaqi Xu, Cuiling Lan, Wenxuan Xie, Xuejin Chen, Yan Lu IEEE Transactions on Multimedia | February 2026
Publication Agentic Media: Reimagining the Future of Communication Yun Wang, Yan Lu MSR-TR-2025-62 | October 2025 Published by Microsoft Project
Publication DAViD: Data-efficient and Accurate Vision Models from Synthetic Data Fatemeh Saleh, Sadegh Aliakbarian, Charlie Hewitt, Lohit Petikam, Xiao-Xian, Antonio Criminisi, Tom Cashman, Tadas Baltrusaitis International Conference on Computer Vision | October 2025 Video
Publication VoluMe – Authentic 3D Video Calls from Live Gaussian Splat Prediction Marti de La Gorce, Charlie Hewitt, Tibor Takacs, Robert Gerdisch, Zafiirah Hosenie, Givi Meishvili, Marek Kowalski (HE/HIM), Tom Cashman, Antonio Criminisi International Conference on Computer Vision | October 2025 Video
Publication Instruction Agent: Enhancing Agent with Expert Demonstration Yinheng Li, Hailey Hultquist, Justin Wagle, Kazuhito Koishida September 2025 arXiv | September 2025