Sitemap
A list of all the posts and pages found on the site. For you robots out there, there is an XML version available for digesting as well.
Pages
Posts
Future Blog Post
Published:
This post will show up by default. To disable scheduling of future posts, edit config.yml and set future: false.
Blog Post number 4
Published:
This is a sample blog post. Lorem ipsum I can’t remember the rest of lorem ipsum and don’t have an internet connection right now. Testing testing testing this blog post. Blog posts are cool.
Blog Post number 3
Published:
This is a sample blog post. Lorem ipsum I can’t remember the rest of lorem ipsum and don’t have an internet connection right now. Testing testing testing this blog post. Blog posts are cool.
Blog Post number 2
Published:
This is a sample blog post. Lorem ipsum I can’t remember the rest of lorem ipsum and don’t have an internet connection right now. Testing testing testing this blog post. Blog posts are cool.
Blog Post number 1
Published:
This is a sample blog post. Lorem ipsum I can’t remember the rest of lorem ipsum and don’t have an internet connection right now. Testing testing testing this blog post. Blog posts are cool.
portfolio
Portfolio item number 1
Short description of portfolio item number 1
Portfolio item number 2
Short description of portfolio item number 2 
publications
Subspace Clustering with Irrelevant Features via Robust Dantzig Selector
Chao Qu, Huan Xu
Conference on Neural Information Processing Systems (NeurIPS), 2015
Fast Rate Analysis of Some Stochastic Optimization Algorithms
Chao Qu, Chongjing Ong, Huan Xu
International Conference on Machine Learning (ICML), 2016
Non-convex Conditional Gradient Sliding
Chao Qu, Yan Li, Huan Xu
International Conference on Machine Learning (ICML), 2018
Nonlinear Distributional Gradient Temporal-Difference Learning
Chao Qu, Shie Mannor, Huan Xu
International Conference on Machine Learning (ICML), 2019
Value Propagation for Decentralized Networked Deep Multi-agent Reinforcement Learning
Chao Qu, Shie Mannor, Huan Xu, Junwu Xiong, Yuan Qi, Le Song
Conference on Neural Information Processing Systems (NeurIPS), 2019
A Meta Reinforcement Learning Approach for Predictive Autoscaling in the Cloud
Siqiao Xue#, Chao Qu#, Xiaoming Shi, Cong Liao, Shiyi Zhu, Xiaoyu Tan, Lintao Ma, Shiyu Wang, Shijun Wang, Yun Hu, Lei Lei, Yangfei Zheng, Jianguo Li, James Zhang
ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD), 2022
Bellman Meets Hawkes: Model-Based Reinforcement Learning via Temporal Point Processes
Chao Qu#, Xiaoyu Tan#, Siqiao Xue, Xiaoming Shi, James Zhang, Hongyuan Mei
AAAI Conference on Artificial Intelligence (AAAI), 2023
Provably Invariance Learning without Domain Information
Xiaoyu Tan, LIN Yong, Shengyu Zhu, Chao Qu, Xihe Qiu, Xu Yinghui, Peng Cui, Yuan Qi
International Conference on Machine Learning (ICML), 2023
SaFER: A Robust and Efficient Framework for Fine-tuning BERT-based Classifier with Noisy Labels
Zhenting Qi, Xiaoyu Tan, Chao Qu, Yinghui Xu and Yuan Qi
Annual Meeting of the Association for Computational Linguistics (ACL), 2023, Industry Track
Gram-based Attentive Neural Ordinary Differential Equations Network for Video Nystagmography Classification
Xihe Qiu, Shaojie Shi, Xiaoyu Tan, Chao Qu, Zhijun Fang, Hailing Wang, Yongbin Gao, Peixia Wu, Huawei Li
IEEE/CVF International Conference on Computer Vision (ICCV), 2023
PILLOW: Enhancing Efficient Instruction Fine-tuning via Prompt Matching
Zhenting Qi, Xiaoyu Tan, Shaojie Shi, Chao Qu, Yinghui Xu, Yuan Qi
Conference on Empirical Methods in Natural Language Processing (EMNLP), 2023, Industry Track
Self-Criticism: Aligning Large Language Models with their Understanding of Helpfulness, Honesty, and Harmlessness
Xiaoyu Tan, Shaojie Shi, Xihe Qiu, Chao Qu, Zhenting Qi, Yinghui Xu, Yuan Qi
Conference on Empirical Methods in Natural Language Processing (EMNLP), 2023, Industry Track
Model-Based Off-Policy Deep Reinforcement Learning With Model-Embedding
Xiaoyu Tan#, Chao Qu#, Junwu Xiong, James Zhang, Xihe Qiu, Yaochu Jin
IEEE Transactions on Emerging Topics in Computational Intelligence
Hybrid Directional Graph Neural Network for Molecules
Junyi An, Chao Qu*, Zhipeng Zhou, Fenglei Cao, Yinghui Xu, Yuan Qi, Furao Shen
International Conference on Learning Representations (ICLR), 2024, Spotlight (top 5%)
LogicMP: A Neuro-symbolic Approach for Encoding First-order Logic Constraints
Weidi Xu, Jingwei Wang, Lele Xie, Jianshan He, Hongting Zhou, Taifeng Wang, Xiaopei Wan, Jingdong Chen, Chao Qu, Wei Chu
International Conference on Learning Representations (ICLR), 2024
Subequivariant Reinforcement Learning Framework for Coordinated Motion Control
Haoyu Wang, Xiaoyu Tan, Xihe Qiu*, Chao Qu*
IEEE International Conference on Robotics and Automation (ICRA), 2024
INF-34B: INF’s Open-Source Large Language Models
Jiaran Hao, Zili Wang, Siming Huang, Tianhao Cheng, LiuYihan Song, Ansheng You, Zhipeng Zhou, Xiaoyu Tan, Dakuan Lu, Xiaoming Shi, Chao Qu, Haozhe Wang, Yinghui Xu, Wei Chu, Yuan Qi
INF Technology Technical Report, 2024
ILTS: Inducing Intention Propagation in Decentralized Multi-Agent Tasks with Large Language Models
Xihe Qiu, Haoyu Wang, Xiaoyu Tan*, Chao Qu*
ACM International Conference on Information and Knowledge Management (CIKM), 2024
ULMR: Unlearning Large Language Models via Negative Response and Model Parameter Average
Shaojie Shi, Xiaoyu Tan, Xihe Qiu, Chao Qu, Kexin Nie, Yuan Cheng, Wei Chu, Xu Yinghui, Yuan Qi
Conference on Empirical Methods in Natural Language Processing (EMNLP), 2024, Industry Track
Adaptive Learning on User Segmentation: Universal to Specific Representation via Bipartite Neural Interaction
Xiaoyu Tan#, Yongxin Deng#, Chao Qu#, Siqiao Xue, Xiaoming Shi, James Zhang, Xihe Qiu
International ACM SIGIR Conference on Research and Development in Information Retrieval (SIGIR-AP), 2024
Cognidual Framework: Self-Training Large Language Models within a Dual-System Theoretical Framework for Improving Cognitive Tasks
Yongxin Deng, Xihe Qiu, Xiaoyu Tan, Chao Qu, Jing Pan, Yuan Cheng, Yinghui Xu, Wei Chu
IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP), 2025
Equivariant Masked Position Prediction for Efficient Molecular Representation
Junyi An#, Chao Qu#, Yun-Fei Shi, XinHao Liu, Qianwei Tang, Fenglei Cao, Yuan Qi
International Conference on Learning Representations (ICLR), 2025
Meta-Agent-Workflow: Streamlining Tool Usage in LLMs through Workflow Construction, Retrieval, and Refinement
Xiaoyu Tan, Bin Li, Xihe Qiu, Chao Qu, Wei Chu, Yinghui Xu, Yuan Qi
The Web Conference (WWW), 2025
Refine Knowledge of Large Language Models via Adaptive Contrastive Learning
Yinghui Li, Haojing Huang, Jiayi Kuang, Yangning Li, Shu-Yu Guo, Chao Qu, Xiaoyu Tan, Hai-Tao Zheng, Ying Shen, Philip S Yu
International Conference on Learning Representations (ICLR), 2025
One Example Shown, Many Concepts Known! Counterexample-Driven Conceptual Reasoning in Mathematical LLMs
Yinghui Li, Jiayi Kuang, Haojing Huang, Zhikun Xu, Xinnian Liang, Yi Yu, Wenlian Lu, Yangning Li, Xiaoyu Tan, Chao Qu, Ying Shen, Hai-Tao Zheng, Philip S Yu
International Conference on Machine Learning (ICML), 2025
Learning Autonomous Code Integration for Math Language Models
Haozhe Wang#, Long Li#, Chao Qu, Fengming Zhu, Weidi Xu, Wei Chu, Fangzhen Lin
Findings of the Association for Computational Linguistics (ACL Findings), 2025
MVP-LLMs: Optimizing Intervention Timing and Subsequent Decision Support for Mechanical Ventilation Parameter Control Using Large Language Models
Teqi Hao, Xiaoyu Tan, Bin Li, Xuemin Wang, Chao Qu, Yinghui Xu, Xihe Qiu
International Conference on Medical Image Computing and Computer-Assisted Intervention (MICCAI), 2025
Prolog-Driven Rule-Based Diagnostics with Large Language Models for Precise Clinical Decision Support
Xiaoyu Tan, Bin Li, Weidi Xu, Chao Qu, Wei Chu, Yinghui Xu, Yuan Qi, Xihe Qiu
International Conference on Medical Image Computing and Computer-Assisted Intervention (MICCAI), 2025
Atomic Thinking of LLMs: Decoupling and Exploring Mathematical Reasoning Abilities
Jiayi Kuang, Haojing Huang, Yinghui Li, Xinnian Liang, Zhikun Xu, Yangning Li, Xiaoyu Tan, Chao Qu, Meishan Zhang, Ying Shen, Philip S Yu
Conference on Neural Information Processing Systems (NeurIPS), 2025
VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning
Haozhe Wang, Chao Qu, Zuming Huang, Wei Chu, Fangzhen Lin, Wenhu Chen
Conference on Neural Information Processing Systems (NeurIPS), 2025, spotlight
AURORA: Automated Training Framework of Universal Process Reward Models via Ensemble Prompting and Reverse Verification
Xiaoyu Tan#, Tianchu Yao#, Chao Qu#, Bin Li, Minghao Yang, Dakuan Lu, Haozhe Wang, Xihe Qiu*, Wei Chu, Yinghui Xu, Yuan Qi
ACM SIGKDD Conference on Knowledge Discovery and Data Mining (KDD), 2026
Constraints-Guided Diffusion Reasoner for Neuro-Symbolic Learning
Xuan Zhang, Zhijian Zhou, Weidi Xu, Yanting Miao, Chao Qu*, Yuan Qi*
AAAI Conference on Artificial Intelligence (AAAI), 2026
The Choice of Divergence: A Neglected Key to Mitigating Diversity Collapse in Reinforcement Learning with Verifiable Reward
Long Li#, Zhijian Zhou#, Jiaran Hao, Jason Klein Liu, Yanting Miao, Wei Pang, Xiaoyu Tan, Wei Chu, Zhe Wang, Shirui Pan, Chao Qu*, Yuan Qi*
International Conference on Learning Representations (ICLR), 2026
Count counts: Motivating Exploration in LLM Reasoning with Count-Based Intrinsic Rewards
Xuan Zhang, Ruixiao Li, Zhijian Zhou, Long Li, Yulei Qin, Ke Li, Xing Sun, Xiaoyu Tan, Chao Qu*, Yuan Qi*
International Conference on Learning Representations (ICLR), 2026
Uni-CoT: Towards Unified Chain-of-Thought Reasoning Across Text and Vision
Luozheng Qin, Jia Gong, Yuqing Sun, Tianjiao Li, Mengping Yang, Xiaomeng Yang, Chao Qu, Zhiyu Tan, Hao Li
International Conference on Learning Representations (ICLR), 2026
SQL-ASTRA: Alleviating Sparse Feedback in Agentic SQL via Column-Set Matching and Trajectory Aggregation
Long Li#, Zhijian Zhou#, Jiangxuan Long, Peiyang Liu, Weidi Xu, Zhe Wang, Shirui Pan, Chao Qu*
Findings of the Association for Computational Linguistics (ACL Findings), 2026
DisPPO: Quantile-Based Distributional Reinforcement Learning for Large Language Models
Zhijian Zhou#, Long Li#, Xuan Zhang, Zongkai Liu, Yanting Miao, Yuchen Liu, Deshu Chen, Ke Li, Xing Sun, Ruoxi Jiang*, Xiaoyu Tan*, Chao Qu*†, Yuan Qi*
International Conference on Machine Learning (ICML), 2026
Nested Spatio-Temporal Time Series Forecasting
YingHao Ai#, Yukai Zhou#, Ruoxi Jiang*, Junyi An, Chao Qu*, Zhijian Zhou, Shiyu Wang, Fenglei Cao, Zenglin Xu, Furao Shen*, Yuan Qi*
International Conference on Machine Learning (ICML), 2026
Start Classifying: Categorical Critics for LLM Reinforcement Learning
Zhijian Zhou#, Long Li#, Xuan Zhang, Zongkai Liu, Yulei Qin, Ke Li, Xing Sun, Xiaoyu Tan*, Chao Qu*†, Yuan Qi*
Conference on Language Modeling (COLM), 2026
talks
Talk 1 on Relevant Topic in Your Field
Published:
This is a description of your talk, which is a markdown file that can be all markdown-ified like any other post. Yay markdown!
Conference Proceeding talk 3 on Relevant Topic in Your Field
Published:
This is a description of your conference proceedings talk, note the different field in type. You can put anything in this field.
teaching
Teaching experience 1
Undergraduate course, University 1, Department, 2014
This is a description of a teaching experience. You can use markdown like any other post.
Teaching experience 2
Workshop, University 1, Department, 2015
This is a description of a teaching experience. You can use markdown like any other post.
