← Xinyuan LiResearch
My work focuses on multimodal foundation models, embodied decision-making under real-time constraints, and the systems that make training and evaluation more efficient.
Publications & Projects
Leyuan Yu*, Xiao Tang*, Minghao Liu*, Xinyuan Li, Xiaokai Bai, Sheng Zhou, Qunshu Lin, Weihao Xuan, Naoto Yokoya
arXiv preprint, 2026 · * Equal contribution.
Current Questions
- Multimodal Foundation Models & World Action Models (WAMs): Exploring VLMs, UMMs, VLAs, and WAMs for perception, reasoning, world modeling, and action.
- Reinforcement Learning: Studying decision-making and policy learning in interactive environments.
- Efficient AI Systems: Building GPU/CUDA environment acceleration, KV streaming cache, FlexAttention masks, and training/inference optimizations.