|
Xiaojuan Qi
Associate Professor
Chow Yei Ching Building, Rm 518
Dept. of Electrical and Electronic Engineering
University of Hong Kong
Hong Kong
Email: xjqi [at] eee.hku.hk
|
|
Biography
I am currently an associate professor at the University of Hong Kong and a member of Deep Vision Lab. My research encompasses the broad areas of Computer Vision, Deep Learning, and Artificial Intelligence. My objective is to equip machines with capabilities for perceiving, understanding, and interacting with the physical world, focusing on the following aspects: 1) World models, 3D reconstruction and generation; 2) multimodal spatial understanding; 3) efficient training and inference; 4) Applications on open-ended intelligent agents (e.g., autonomous driving, embodied agents). Besides, I am also interested in utilizing AI to advance scientific and medical research (AI for Science and Medicine).
I obtained my Ph.D. degree in
Computer Science and Engineering Department,
The Chinese University of Hong Kong (CUHK), supervised by
Prof. Jiaya Jia in 2018. Before that, I got the B.Eng. degree in Electronic Science and Technology at
Shanghai Jiao Tong University (SJTU) supervised by
Prof. Ya Zhang in 2014.
Please email me if you are interested in joining my lab. We have one Postdoc opening in vision for robotics. Please contact me if you are interested in this opportunity.
Experiences
Selected Publications [Google Scholar]
*: equal contribution, #: corresponding author
2026
-
Efficient and accurate neural field reconstruction using resistive memory
Yifei Yu, Xinyuan Zhang, Shaocong Wang, Woyu Zhang, Xiuzhe Wu, Yangu He, Jichang Yang, Yue Zhang, Ning Lin, Bo Wang, Xi Chen, Songqi Wang, Xiaoshan Wu, Shihao Han, Yi Li, Meng Xu, Hegan Chen, Wenkui Zhang, Jingyi Chen, Xumeng Zhang, Xiaojuan Qi#, Dashan Shang#, Qi Liu#, Zhongrui Wang#, Kwang-Ting Cheng, and Ming Liu.
Nature 654, pages 642–651, 2026.
-
AniGen: Unified S3 Fields for Animatable 3D Asset Generation
Yi-Hua Huang, Zi-Xin Zou, Yuting He, Chirui Chang, Cheng-Feng Pu, Ziyi Yang, Yuan-Chen Guo, Yan-Pei Cao#, Xiaojuan Qi#.
ACM Transactions on Graphics (TOG) (also appeared in SIGGRAPH), 2026.
-
S2VG: 3D Stereoscopic and Spatial Video Generation via Denoising Frame Matrix
Peng Dai, Feitong Tan, Qiangeng Xu, Yihua Huang, David Futschik, Ruofei Du, Sean Fanello, Yinda Zhang#, Xiaojuan Qi#.
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2026.
-
Understanding Data Influence with Differential Approximation
Haoru Tan, Sitong Wu, Xiuzhe Wu, Wang Wang, Bo Zhao, Zeke Xie, Gui-Song Xia, Xiaojuan Qi#.
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2026.
-
MC#: Mixture Compressor for Mixture-of-Experts Large Models
Wei Huang, Yue Liao, Yukang Chen, Jianhui Liu, Haoru Tan, Si Liu, Shiming Zhang, Shuicheng Yan, Xiaojuan Qi#.
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2026.
-
Veda: Scalable Video Diffusion via Distilled Sparse Attention
Shihao Han, Hao Yang, Xinting Hu, Xiaofeng Mei, Yi Jiang, Xiaojuan Qi.
International Conference on Machine Learning (ICML), 2026.
-
Absorbing Quantization Error by Deformable Noise Scheduler for Diffusion Models
Mingrui Yang, Wei Huang, Hao Nan SHENG, Donglin Yang, Jichang Yang, Xin Yu, Huining Yu, Yuzhong Jiao, Zhongrui Wang, Xiaojuan Qi.
International Conference on Machine Learning (ICML), 2026.
-
Stable Velocity: A Variance Perspective on Flow Matching
Donglin Yang, Yongxing Zhang, Xin Yu, Liang Hou, Xin Tao, Pengfei Wan, Xiaojuan Qi#, Renjie Liao#.
International Conference on Machine Learning (ICML), 2026.
-
Self-Evaluation Unlocks Any-Step Text-to-Image Generation
Xin Yu, Xiaojuan Qi#, Zhengqi Li, Kai Zhang, Richard Zhang, Zhe Lin, Eli Shechtman, Tianyu Wang, Yotam Nitzan.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
-
Dataset Distillation via Influence Matching
Haoru Tan, Wang Wang, Sitong Wu, Xiuzhe Wu, Yang-Tian Sun, Chirui Chang, Shaofeng Zhang, Xiaojuan Qi#.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
-
Stereo World Model
Yang-Tian Sun, Zehuan Huang, Yifan Niu, Lin Ma, Yan-Pei Cao, Yuewen Ma, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
-
Learning to See through Illumination Extremes with Event Streaming in Multimodal Large Language Models
Baoheng Zhang, Jiahui Liu, Zhao Gui, Zhang Weizhou, Yixuan Ma, Jun Jiang, Yingxian Chen, Wilton.W.T. Fok, Xiaojuan Qi#, Hayden Kwok-Hay So#.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
-
ObjectMorpher: 3D-Aware Image Editing via Deformable 3DGS
Yuhuan Xie, Aoxuan Pan, Yi-Hua Huang, Chirui Chang, Peng Dai, Xin Yu, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
-
Stabilizing Streaming Video Geometry via Dynamic Feature Normalization
Xiaoyang Lyu, Muxin Liu, Xiaoshan Wu, Ruicheng Wang, Yi-Hua Huang, Yang-Tian Sun, Shaoshuai Shi, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
-
Dynamic Important Example Mining for Reinforcement Finetuning
Haoru Tan, Sitong Wu, Yanfeng Chen, Shizhen Zhao, Yang-Tian Sun, Tianjia Liu, Chirui Chang, Shaofeng Zhang, Samm Sun, Xiuzhe Wu, Ruobing Xie, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
-
Learning to Reason in 4D: Dynamic Spatial Understanding for Vision Language Models
Shengchao Zhou, Yuxin Chen, Yuying Ge, Wei Huang, Jiehong Lin, Ying Shan, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2026.
-
Fast Data Mixture Optimization via Gradient Descent
Haoru Tan, Sitong Wu, Yanfeng Chen, Jun Xia, Ruobing Xie, Bin Xia, Xingwu Sun, Xiaojuan Qi.
International Conference on Learning Representations (ICLR), 2026.
-
QeRL: Beyond Efficiency - Quantization-enhanced Reinforcement Learning for LLMs
Wei Huang, Yi Ge, Shuai Yang, Yicheng Xiao, Huizi Mao, Yujun Lin, Hanrong Ye, Sifei Liu, Ka Chun Cheung, Hongxu Yin, Yao Lu, Xiaojuan Qi, Song Han, Yukang Chen.
International Conference on Learning Representations (ICLR), 2026.
-
Easier Painting Than Thinking: Can Text-to-Image Models Set the Stage, but Not Direct the Play?
Ouxiang Li, Yuan Wang, Xinting Hu, Huijuan Huang, Rui Chen, Jiarong Ou, Xin Tao, Pengfei Wan, Xiaojuan Qi, Fuli Feng.
International Conference on Learning Representations (ICLR), 2026.
-
Efficient Prediction of Large Protein Complexes via Subunit-Guided Hierarchical Refinement
Chixiang Lu, Yunhua Zhong, Shikang Liang, Xiaojuan Qi#, Haibo Jiang.
International Conference on Learning Representations (ICLR), 2026.
-
LiFR-Seg: Anytime High-Frame-Rate Segmentation via Event-Guided Propagation
Xiaoshan Wu, Xiaoyang Lyu, Yifei Yu, Bo Wang, Zhongrui Wang, Xiaojuan Qi.
International Conference on Learning Representations (ICLR), 2026.
-
MindOmni: Unleashing Reasoning Generation in Vision Language Models with RGPO
Yicheng Xiao, Lin Song, Yukang Chen, Yingmin Luo, Yuxin Chen, Yukang Gan, Wei Huang, Xiu Li, Xiaojuan Qi, Ying Shan.
International Conference on Learning Representations (ICLR), 2026.
2025
-
Efficient Modeling of Ionic and Electronic Interactions by a Resistive Memory-based Reservoir Graph Neural Network
Meng Xu, Shaocong Wang, Yangu He, Yi Li, Woyu Zhang, Ming Yang, Xiaojuan Qi#, Zhongrui Wang#, Ming Xu#, Dashan Shang#, Qi Liu, Xiangshui Miao, Ming Liu.
Nature Computational Science, 2025.
-
GO-NeRF: Generating Objects in Neural Radiance Fields for Virtual Reality Content Creation
Peng Dai, Feitong Tan, Xin Yu, Yifan Peng, Yinda Zhang, Xiaojuan Qi#.
IEEE Transactions on Visualization and Computer Graphics (TVCG) (also appeared in IEEE VR), 2025.
-
Resistive Memory-based Zero-shot Liquid State Machine for Multimodal Event Data Learning
Ning Lin, Shaocong Wang, Yi Li, Bo Wang, Shuhui Shi, Yangu He, Woyu Zhang, Yifei Yu, Yue Zhang, Xinyuan Zhang, Kwunhang Wong, Songqi Wang, Xiaoming Chen, Hao Jiang, Xumeng Zhang, Peng Lin, Xiaoxin Xu, Xiaojuan Qi, Zhongrui Wang#, Dashan Shang#, Qi Liu, Ming Liu.
Nature Computational Science, vol. 5, pp. 37–47, 2025.
-
SeqTex: Generate Mesh Textures in Video Sequence
Ze Yuan, Xin Yu, Yangtian Sun, Yuan-Chen Guo, Yan-Pei Cao, Ding Liang, Xiaojuan Qi#.
Proceedings of SIGGRAPH Asia, 2025.
-
Scaling RL to Long Videos
Yukang Chen, Wei Huang, Baifeng Shi, Qinghao Hu, Hanrong Ye, Ligeng Zhu, Zhijian Liu, Pavlo Molchanov, Jan Kautz, Xiaojuan Qi, Sifei Liu, Hongxu Yin, Yao Lu, Song Han.
Conference on Neural Information Processing Systems (NeurIPS), 2025.
-
Vision Foundation Models as Effective Visual Tokenizers for Autoregressive Generation
Anlin Zheng, Xin Wen, Xuanyang Zhang, Chuofan Ma, Tiancai Wang, Gang Yu, Xiangyu Zhang, Xiaojuan Qi#.
Conference on Neural Information Processing Systems (NeurIPS), 2025.
-
EAG3R: Event-Augmented 3D Geometry Estimation for Dynamic and Extreme-Lighting Scenes
Xiaoshan Wu, Yifei Yu, Xiaoyang Lyu, Yi-Hua Huang, Bo Wang, Baoheng Zhang, Zhongrui Wang#, Xiaojuan Qi#.
Conference on Neural Information Processing Systems (NeurIPS), 2025.
Spotlight
-
DLoFT: Gradient-Decoupled Fine-Tuning for Generalizable Long Chain-of-Thought Reasoning
Sitong Wu, Haoru Tan, Jingyao Li, Shaofeng Zhang, Xiaojuan Qi, Bei Yu, Jiaya Jia.
Conference on Neural Information Processing Systems (NeurIPS), 2025.
-
UniTok: a Unified Tokenizer for Visual Generation and Understanding
Chuofan Ma, Yi Jiang, Junfeng Wu, Jihan Yang, Xin Yu, Zehuan Yuan, Bingyue Peng, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2025.
Spotlight
-
Understanding Data Influence in Reinforcement Finetuning
Haoru Tan, Xiuzhe Wu, Sitong Wu, Shaofeng Zhang, Yanfeng Chen, Xingwu Sun, Jeanne Shen, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2025.
-
Equipping Vision Foundation Model with Mixture of Experts for Out-of-Distribution Detection
Shizhen Zhao, Jiahui Liu, Xin Wen, Haoru Tan, Xiaojuan Qi.
IEEE International Conference on Computer Vision (ICCV), 2025.
-
“Principal Components” Enable A New Language of Images
Xin Wen, Bingchen Zhao, Ismail Elezi, Jiankang Deng, Xiaojuan Qi.
IEEE International Conference on Computer Vision (ICCV), 2025.
-
How Far are AI-generated Videos from Simulating the 3D Visual World: A Learned 3D Evaluation Approach
Chirui CHANG, Jiahui Liu, Zhengzhe Liu, Xiaoyang Lyu, Yi-Hua Huang, Xin Tao, Pengfei Wan, Di Zhang, Xiaojuan Qi.
IEEE International Conference on Computer Vision (ICCV), 2025.
-
Aligning Effective Tokens with Video Anomaly in Large Language Models
Yingxian Chen, Jiahui Liu, Ruidi Fan, Yanwei Li, Chirui CHANG, Shizhen Zhao, Wilton.W.T. Fok, Xiaojuan Qi, Yik Chung Wu.
IEEE International Conference on Computer Vision (ICCV), 2025.
-
Holistic Tokenizer for Autoregressive Image Generation
Anlin Zheng, Haochen Wang, Yucheng Zhao, Weipeng Deng, Tiancai Wang, Xiangyu Zhang, Xiaojuan Qi.
IEEE International Conference on Computer Vision (ICCV), 2025.
-
SliM-LLM: Salience-Driven Mixed-Precision Quantization for Large Language Models
Wei Huang, Haotong Qin, Yangdong Liu, Yawei Li, Qinshuo Liu, Xianglong Liu, Luca Benini, Michele Magno, Shiming Zhang, Xiaojuan Qi.
International Conference on Machine Learning (ICML), 2025.
-
A Data-Centric Revisit of Pre-Trained Vision Models for Robot Learning
Xin Wen, Bingchen Zhao, Yilun Chen, Jiangmiao Pang, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2025.
-
Deformable Radial Kernel Splatting
Yi-Hua Huang, Mingxian Lin, Yang-Tian Sun, Ziyi Yang, Xiaoyang Lyu, Yan-Pei Cao, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2025.
-
Learning from Neighbors: Category Extrapolation for Long-Tail Learning
Shizhen Zhao, Xin Wen, Jiahui Liu, Chuofan Ma, Chunfeng Yuan, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2025.
-
ObjectMover: Generative Object Movement with Video Prior
Xin Yu, Tianyu Wang, Soo Ye Kim, Paul Guerrero, Xi Chen, Qing Liu, Zhe Lin, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2025.
-
Data Pruning by Information Maximization
Haoru Tan*, Sitong Wu*, Wei Huang, Shizhen Zhao, Xiaojuan Qi.
International Conference on Learning Representations (ICLR), 2025.
-
MC-MoE: Mixture Compressor for Mixture-of-Experts LLMs Gains More
Wei Huang*, Yue Liao*, Jianhui Liu, Ruifei He, Haoru Tan, Shiming Zhang, Hongsheng Li, Si Liu, Xiaojuan Qi.
International Conference on Learning Representations (ICLR), 2025.
-
SVG: 3D Stereoscopic Video Generation via Denoising Frame Matrix
Peng Dai, Feitong Tan, Qiangeng Xu, David Futschik, Ruofei Du, Sean Fanello, Xiaojuan Qi#, Yinda Zhang#.
International Conference on Learning Representations (ICLR), 2025.
2024
-
Lowis3d: Language-driven open-world instance-level 3d scene understanding
Runyu Ding, Jihan Yang, Chuhui Xue, Wenqing Zhang, Song Bai, Xiaojuan Qi#.
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2024.
[Code].
-
Diffusion-based deep learning method for augmenting ultrastructural imaging and volume electron microscopy
Chixiang Lu, Kai Chen, Heng Qiu, Xiaojun Chen, Gu Chen, Xiaojuan Qi#, Haibo Jiang#.
Nature Communications, 2024.
[Code].
-
Tool to Resolve Distortions in Elemental and Isotopic Imaging
Chixiang Lu, Gu Chen, Wenxin Song, Kai Chen, Charmaine Hee, Mehran Nikan, Paul Guagliardo, C Frank Bennett, Punit Seth, Killugudi Swaminathan Iyer, Stephen G Young, Xiaojuan Qi#, Haibo Jiang#.
Journal of the American Chemical Society (JACS), 2024.
[Code].
-
High-dimensional anticounterfeiting nanodiamonds authenticated with deep metric learning
Lingzhi Wang*, Xin Yu*, Tongtong Zhang, Yong Hou, Dangyuan Lei, Xiaojuan Qi#, Zhiqin Chu#.
Nature Communications, 2024.
[Code].
-
Object-centric Representation Learning for Video Scene Understanding
Yi Zhou, Hui Zhang, Seung-In Park, ByungIn Yoo, Xiaojuan Qi#.
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2024.
[Code].
-
What Makes CLIP More Robust to Long-Tailed Pre-Training Data? A Controlled Study for Transferable Insights
Xin Wen, Bingchen Zhao, Yilun Chen, Jiangmiao Pang, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2024.
[Project Page]
-
Splatter a Video: Video Gaussian Representation for Versatile Processing
Yang-Tian Sun*, Yi-Hua Huang*, Lin Ma, Xiaoyang Lyu, Yan-Pei Cao, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2024.
[Project Page]
-
Spec-Gaussian: Anisotropic View-Dependent Appearance for 3D Gaussian Splatting
Ziyi Yang, Xinyu Gao, Yangtian Sun, Yihua Huang, Xiaoyang Lyu, Wen Zhou, Shaohui Jiao, Xiaojuan Qi, Xiaogang Jin.
Conference on Neural Information Processing Systems (NeurIPS), 2024.
[Project Page]
-
Decoupled Kullback-Leibler (DKL) Divergence Loss
Jiequan Cui, Zhuotao Tian, Zhisheng Zhong, Xiaojuan Qi, Bei Yu, Hanwang Zhang.
Conference on Neural Information Processing Systems (NeurIPS), 2024.
[Project Page]
-
BiLLM: Pushing the Limit of Post-Training Quantization for LLMs
Wei Huang, Yangdong Liu, Haotong Qin, Ying Li, Shiming Zhang, Xianglong Liu, Michele Magno, Xiaojuan Qi.
International Conference on Machine Learning (ICML), 2024.
[Project Page].
-
TEXGen: a Generative Diffusion Model for Mesh Textures
Xin Yu, Ze Yuan, Yuan-Chen Guo, Ying-Tian Liu, Jianhui Liu, Yangguang Li, Yan-Pei Cao, Ding Liang Xiaojuan Qi#.
ACM Transactions on Graphics (TOG) (also appeared in SIGGRAPH Asia), 2024.
[Code]
Best Paper Honorable Mention
-
3DGSR: Implicit Surface Reconstruction with 3D Gaussian Splatting
Xiaoyang Lyu, Yang-Tian Sun, Yi-Hua Huang, Xiuzhe Wu, Ziyi Yang, Yilun Chen, Jiangmiao Pang, Xiaojuan Qi#.
ACM Transactions on Graphics (TOG) (also appeared in SIGGRAPH Asia), 2024.
[Code]
-
Groma: Localized Visual Tokenization for Grounding Multimodal Large Language Models
Chuofan Ma, Yi Jiang, Jiannan Wu, Zehuan Yuan, Xiaojuan Qi.
European Conference on Computer Vision (ECCV), 2024.
[Project Page]
-
Can OOD Object Detectors Learn from Foundation Models?
Jiahui Liu, Xin Wen, Shizhen Zhao, Yingxian Chen, Xiaojuan Qi.
European Conference on Computer Vision (ECCV), 2024.
[Project Page]
-
V-IRL: Grounding Virtual Intelligence in Real Life
Jihan Yang, Runyu Ding, Ellis L Brown, Xiaojuan Qi, Saining Xie.
European Conference on Computer Vision (ECCV), 2024.
[Project Page]
-
3D-Aware Text-Driven Talking Avatar Generation
Xiuzhe Wu, Yang-Tian Sun, Handi Chen, Hang Zhou, Jingdong Wang, Zhengzhe Liu, Xiaojuan Qi.
European Conference on Computer Vision (ECCV), 2024.
[Project Page]
-
UniDream: Unifying Diffusion Priors for Relightable Text-to-3D Generation
Zexiang Liu, Yangguang Li, Youtian Lin, Xin Yu, Sida Peng, Yan-Pei Cao, Xiaojuan Qi, Xiaoshui Huang, Ding Liang*, Wanli Ouyang.
European Conference on Computer Vision (ECCV), 2024.
[Project Page]
-
Total-Decom: Decomposed 3D Scene Reconstruction with Minimal Interaction
Xiaoyang Lyu*, Chirui CHANG*, Peng Dai, Yang-Tian_Sun, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2024.
[Code].
Highlight (3.6% acceptance rate)
-
RegionPLC: Regional Point-Language Contrastive Learning for Open-World 3D
Scene Understanding
Jihan Yang, Runyu Ding, Weipeng DENG, Zhe Wang, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2024.
[Code][Project Page].
-
SC-GS: Sparse-Controlled Gaussian Splatting for Editable Dynamic Scenes
Yi-Hua Huang, Yang-Tian Sun, Ziyi Yang, Xiaoyang Lyu, Yan-Pei Cao, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2024.
[Code][Project Page].
-
EscherNet: A Generative Model for Scalable View Synthesis
Xin Kong, Shikun Liu, Xiaoyang Lyu, Marwan Taher, Xiaojuan Qi, Andrew Davison.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2024.
[Project Page].
Oral (0.8% acceptance rate)
-
SaCo Loss: Sample-wise Affinity Consistency for Vision-Language Pre-training
Sitong Wu, Haoru Tan, Zhuotao Tian, Yukang Chen, Xiaojuan Qi, Jiaya Jia.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2024.
[Project Page].
-
Classes Are Not Equal: An Empirical Study on Image Recognition Fairness
Jiequan Cui, Beier Zhu, Xin Wen, Xiaojuan Qi, Bei Yu, Hanwang Zhang.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2024.
[Project Page].
-
Text-to-3d with classifier score distillation
Xin Yu, Yuan-Chen Guo, Yangguang Li, Ding Liang, Song-Hai Zhang,Xiaojuan Qi.
International Conference on Learning Representations (ICLR), 2024.
[Code][Project Page].
2023
-
CoDet: Co-occurrence Guided Region-Word Alignment for Open-Vocabulary Object Detection
Chuofan Ma, Yi Jiang, Xin Wen, Zehuan Yuan, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2023.
[Code]
-
Data Pruning via Moving-one-Sample-out
Haoru Tan, Sitong Wu, Fei Du, Yukang Chen, Zhibin Wang, Fan Wang, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2023.
[Code]
-
CL-NeRF: Continual Learning of Neural Radiance Fields for Evolving Scene Representation
Xiuzhe Wu, Peng Dai, Weipeng DENG, Handi Chen, Yang Wu, Yan-Pei Cao, Ying Shan, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2023.
[Code]
-
EXIM: A Hybrid Explicit-Implicit Representation for Text-Guided 3D Shape Generation
Zhengzhe Liu, Jingyu Hu, Ka-Hei Hui, Xiaojuan Qi#, Daniel Cohen-Or, Chi-Wing Fu#.
ACM Transactions on Graphics (TOG) (also appeared in SIGGRAPH Asia), 2023.
[Code]
-
DreamStone: Image as a Stepping Stone for Text-Guided 3D Shape Generation
Zhengzhe Liu, Peng Dai, Xiaojuan Qi#, Chi-Wing Fu#.
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2023.
[Code].
-
Vertical Layering of Quantized Neural Networks for Heterogeneous Inference
Hai Wu, Ruifei He, Haoru Tan, Xiaojuan Qi, Kaibin Huang#.
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2023.
[Code].
-
Parametric Classification for Generalized Category Discovery: A Baseline Study
Xin Wen*, Bingchen Zhao*, Xiaojuan Qi.
IEEE International Conference on Computer Vision (ICCV), 2023.
[Code].
-
Texture Generation on 3D Meshes with Point-UV Diffusion
Xin Yu, Peng Dai, Wenbo Li, Lan Ma, Zhengzhe Liu, Xiaojuan Qi.
IEEE International Conference on Computer Vision (ICCV), 2023.
[Code].
Oral (2.4 % acceptance rate)
-
Prior-free Category-level Pose Estimation with Implicit Space Transformation
Jianhui Liu, Yukang Chen, Xiaoqing Ye, Xiaojuan Qi.
IEEE International Conference on Computer Vision (ICCV), 2023.
[Code].
-
Learning a Room with the Occ-SDF Hybrid: Signed Distance Function Mingled with Occupancy Aids Scene Representation
Xiaoyang Lyu, Peng Dai, Zizhang Li, Dongyu Yan, Yi Lin, Yifan Peng, Xiaojuan Qi.
IEEE International Conference on Computer Vision (ICCV), 2023.
[Code].
-
Speech2Lip: High-fidelity Speech to Lip Generation by Learning from a Short Video
Xiuzhe Wu, Pengfei Hu, Yang Wu, Xiaoyang Lyu, Yan-Pei Cao, Ying Shan, Wenming Yang, Zhongqian Sun, Xiaojuan Qi.
IEEE International Conference on Computer Vision (ICCV), 2023.
[Code].
-
PLA: Language-Driven Open-Vocabulary 3D Scene Understanding
Runyu Ding, Jihan Yang, Chuhui Xue, Wenqing Zhang, Song Bai, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2023.
[Code].
-
Hybrid Neural Rendering for Large-Scale Scenes with Motion Blur
Peng Dai*, Yinda Zhang*, Xin Yu, Xiaoyang Lyu, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2023.
[Code].
-
MarS3D: A Plug-and-Play Motion-Aware Model for Semantic Segmentation on Multi-Scan 3D Point Clouds
Jiahui Liu*, Chirui Chang*, Jianhui Liu, Xiaoyang Wu, Lan Ma, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2023.
[Code].
-
LargeKernel3D: Scaling Up Kernels in 3D Sparse CNNs
Yukang Chen*, Jianhui Liu*, Xiangyu Zhang, Xiaojuan Qi, Jiaya Jia.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2023.
[Code].
-
VoxelNeXt: Fully Sparse VoxelNet for 3D Object Detection and Tracking
Yukang Chen*, Jianhui Liu*, Xiangyu Zhang, Xiaojuan Qi, Jiaya Jia.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2023.
[Code].
-
Command-Driven Articulated Object Understanding and Manipulation
Ruihang Chu, Zhengzhe Liu, Xiaoqing Ye, Xiao Tan, Xiaojuan Qi, Chi-Wing Fu, Jiaya Jia.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2023.
[Code].
-
Understanding Imbalanced Semantic Segmentation Through Neural Collapse
Zhisheng Zhong*, Jiequan Cui*, Yibo Yang*, Xiaoyang Wu, Xiaojuan Qi, Xiangyu Zhang, Jiaya Jia.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2023.
[Code].
-
DPACS: Hardware Accelerated Dynamic Neural Network Pruning through Algorithm-Architecture Co-design
Yizhao Gao*, Baoheng Zhang*, Xiaojuan Qi, Hayden Kwok-Hay So.
Proceedings of the 28th ACM International Conference on Architectural Support for Programming Languages and Operating Systems (ASPLOS), 2023.
-
Is synthetic data from generative models ready for image recognition?
Ruifei He, Shuyang Sun, Xin Yu, Chuhui Xue, Wenqing Zhang, Philip Torr, Song Bai, Xiaojuan Qi.
International Conference on Learning Representations (ICLR, 2023.
[Code].
Spotlight
-
ISS: Image as Stepping Stone for Text-Guided 3D Shape Generation
Zhengzhe Liu, Peng Dai, Ruihui Li, Xiaojuan Qi, Chi-Wing Fu.
International Conference on Learning Representations (ICLR), 2023.
[Code][Project Page].
Spotlight
2022
-
St3d++: Denoised self-training for unsupervised domain adaptation on 3d object detection
Jihan Yang, Shaoshuai Shi, Zhe Wang, Hongsheng Li, Xiaojuan Qi#.
IEEE Transactions on Pattern Analysis & Machine Intelligence (TPAMI), 2022.
[Code]
-
Self-Supervised Visual Representation Learning with Semantic Grouping
Xin Wen, Bingchen Zhao, Anlin Zheng, Xiangyu Zhang, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2022.
[Code]
-
Towards Efficient 3D Object Detection with Knowledge Distillation
Jihan Yang, Shaoshuai Shi, Runyu Ding, Zhe Wang, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2022.
[Code]
-
Prototypical VoteNet for Few-Shot 3D Point Cloud Object Detection
Shizhen Zhao, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2022.
[Code]
-
Rethinking Resolution in the Context of Efficient Video Recognition
Chuofan Ma, Qiushan Guo, Yi Jiang, Ping Luo, Zehuan Yuan, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2022.
[Code]
-
Spatial Pruned Sparse Convolution for Efficient 3D Object Detection
Jianhui Liu*, Yukang Chen*, Xiaoqing Ye, Zhuotao Tian, Xiao Tan, Xiaojuan Qi.
Conference on Neural Information Processing Systems (NeurIPS), 2022.
[Code]
-
Unifying Voxel-based Representation with Transformer for 3D Object Detection
Yanwei Li, Yilun Chen, Xiaojuan Qi, Zeming Li, Jian Sun, Jiaya Jia.
Conference on Neural Information Processing Systems (NeurIPS), 2022.
[Code]
-
DODA: Data-oriented Sim-to-Real Domain Adaptation for 3D Semantic Segmentation
Runyu Ding*, Jihan Yang*, Li Jiang, Xiaojuan Qi.
European Conference on Computer Vision (ECCV), 2022.
[Code]
-
Towards Efficient and Scale-Robust Ultra-High-Definition Image Demoireing
Xin Yu, Peng Dai, Wenbo Li, Lan Ma, Jiajun Shen, Jia Li, Xiaojuan Qi.
European Conference on Computer Vision (ECCV), 2022.
[Code]
-
Knowledge Distillation As Efficient Pre-Training: Faster Convergence, Higher Data-Efficiency, and Better Transferability
Ruifei He, Shuyang Sun*, Jihan Yang*, Song Bai, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2022.
[Code]
-
HINT: Hierarchical Neuron Concept Explainer
Andong Wang, Wei-Ning Lee, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2022.
[Code]
-
Video Demoireing With Relation-Based Temporal Consistency
Peng Dai, Xin Yu, Lan Ma, Baoheng Zhang, Jia Li, Wenbo Li, Jiajun Shen, Xiaojuan Qi.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2022.
[Code]
-
Voxel Field Fusion for 3D Object Detection
Yanwei Li, Xiaojuan Qi, Yukang Chen, Liwei Wang, Zeming Li, Jian Sun, Jiaya Jia.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2022.
[Code]
-
Stratified Transformer for 3D Point Cloud Segmentation
Xin Lai*, Jianhui Liu*, Li Jiang, Liwei Wang, Hengshuang Zhao, Shu Liu, Xiaojuan Qi, Jiaya Jia.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2022.
[Code]
-
Towards Implicit Text-Guided 3D Shape Generation
Zhengzhe Liu, Yi Wang, Xiaojuan Qi, Chi-Wing Fu.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2022.
[Code]
-
Slot-VPS: Object-Centric Representation Learning for Video Panoptic Segmentation
Yi Zhou, Hui Zhang, Hana Lee, Shuyang Sun, Pingjun Li, Yangguang Zhu, ByungIn Yoo, Xiaojuan Qi, Jae-Joon Han.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2022.
-
TWIST: Two-Way Inter-Label Self-Training for Semi-Supervised 3D Instance Segmentation
Ruihang Chu, Xiaoqing Ye, Zhengzhe Liu, Xiao Tan, Xiaojuan Qi, Chi-Wing Fu, Jiaya Jia.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2022.
[Code]
-
Progressive End-to-End Object Detection in Crowded Scenes
Anlin Zheng, Yuang Zhang, Xiangyu Zhang, Xiaojuan Qi, Jian Sun.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2022.
[Code]
2021
-
Re-distributing Biased Pseudo Labels for Semi-supervised Semantic Segmentation: A Baseline Investigation
Ruifei He*, Jihan Yang*, Xiaojuan Qi
IEEE International Conference on Computer Vision (ICCV), 2021.
Oral (3.4% acceptance rate)
[Code]
-
Aggregation with Feature Detection
Shuyang Sun, Xiaoyu Yue, Xiaojuan Qi, Wanli Ouyang, Victor Prisacariu, Philip H.S. Torr
IEEE International Conference on Computer Vision (ICCV), 2021.
-
ST3D: Self-training for Unsupervised Domain Adaptation on 3D Object Detection
Jihan Yang*, Shaoshuai Shi*, Zhe Wang, Hongsheng Li, Xiaojuan Qi.
IEEE Conference on Computer Vision and pattern Recognition (CVPR), 2021.
[Code]
-
PAConv: Position Adaptive Convolution with Dynamic Kernel Assembling on Point Clouds
Mutian Xu*, Runyu Ding*, Hengshuang Zhao, Xiaojuan Qi.
IEEE Conference on Computer Vision and pattern Recognition (CVPR), 2021.
[Code]
-
3D-to-2D Distillation for Indoor Scene Parsing
Zhengzhe Liu, Xiaojuan Qi, Chi-Wing Fu
IEEE Conference on Computer Vision and pattern Recognition (CVPR), 2021.
Oral (4.3% acceptance rate)
[Code]
-
Fully Convolutional Networks for Panoptic Segmentation
Yanwei Li, Hengshuang Zhao, Xiaojuan Qi, Liwei Wang, Zeming Li, Jian Sun, Jiaya Jia
IEEE Conference on Computer Vision and pattern Recognition (CVPR), 2021.
Oral (4.3% acceptance rate)
[Code]
-
One Thing One Click: A Self-Training Approach for Weakly Supervised 3D Semantic Segmentation
Zhengzhe Liu, Xiaojuan Qi, Chi-Wing Fu
IEEE Conference on Computer Vision and pattern Recognition (CVPR), 2021.
[Code]
2020
-
Lightweight Generative Adversarial Networks for Text-guided Image Manipulation
Bowen Li, Xiaojuan Qi, Philip H.S. Torr, Thomas Lukasiewicz.
Conference on Neural Information Processing Systems (NeurIPS), 2020.
-
GeoNet++: Iterative Geometric Neural Network with Edge-Aware Refinement for Joint Depth and Surface Normal Estimation
Xiaojuan Qi*, Zhengzhe Liu*, Renjie Liao, Philip H. S. Torr, Raquel Urtasun, Jiaya Jia.
IEEE Transactions on Pattern Analysis and Machine Intelligence (TPAMI), 2020.
[Code][Training data]
-
Domain-invariant Stereo Matching Networks
Feihu Zhang, Xiaojuan Qi, Ruigang Yang, Victor Adrian Prisacariu, Benjamin Wah, Philip H.S. Torr.
European Conference on Computer Vision (ECCV), 2020.
Oral (2% acceptance rate)
[Code]
-
Few-shot Action Recognition via Improved Attention with Self-supervision
Hongguang Zhang, Li Zhang, Xiaojuan Qi, Hongdong Li, Philip H.S. Torr, Piotr Koniusz.
European Conference on Computer Vision (ECCV), 2020.
Spotlight (5% acceptance rate)
-
CN: Channel Normalization For Point Cloud
Recognition
Zetong Yang*, Yanan Sun*, Shu Liu, Xiaojuan Qi, Jiaya Jia.
European Conference on Computer Vision (ECCV), 2020.
-
Memory Selection Network for
Video Propagation
Ruizheng Wu*, Huaijia Lin*, Xiaojuan Qi, Jiaya Jia.
European Conference on Computer Vision (ECCV), 2020.
-
Global Texture Enhancement for Fake Face Detection in the Wild
Zhengzhe Liu, Xiaojuan Qi, Philip H.S. Torr.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2020.
[Code]
-
Unifying Training and Inference for Panoptic Segmentation
Qizhu Li, Xiaojuan Qi, Philip H.S. Torr.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2020.
-
ManiGAN: Text-Guided Image Manipulation
Bowen Li, Xiaojuan Qi, Thomas Lukasiewicz, Philip H.S. Torr.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2020.
[Code]
Before 2020
-
Controllable Text-to-Image Generation
Bowen Li, Xiaojuan Qi, Thomas Lukasiewicz, Philip H.S. Torr.
Conference on Neural Information Processing Systems (NeurIPS), 2019.
[Code]
-
AGSS-VOS: Attention Guided Single-Shot Video Object Segmentation
Huaijia Lin, Xiaojuan Qi, Jiaya Jia.
IEEE International Conference on Computer Vision (ICCV), 2019.
[Code]
-
Improved Techniques for Training Adaptive Deep Networks
Hao Li*, Hong Zhang*, Xiaojuan Qi, Ruigang Yang, Gao Huang.
IEEE International Conference on Computer Vision (ICCV), 2019.
-
3D Motion Decomposition for RGBD Future Dynamic Scene Synthesis
Xiaojuan Qi*, Zhengzhe Liu*, Qifeng Chen, Jiaya Jia.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2019.
-
Image Inpainting via Generative Multi-column Convolutional Neural Networks
Yi Wang, Xin Tao, Xiaojuan Qi, Xiaoyong Shen, Jiaya Jia.
Conference on Neural Information Processing Systems (NIPS), 2018.
[Code]
-
ICNet for Real-Time Semantic Segmentation on High-Resolution Images
Hengshuang Zhao, Xiaojuan Qi, Xiaoyong Shen, Jianping Shi, Jiaya Jia
European Conference on Computer Vision (ECCV), 2018.
[Code]
-
GAL: Geometric Adversarial Loss for Single-View 3D-Object Reconstruction
Li Jiang, Shaoshuai Shi, Xiaojuan Qi, Jiaya Jia.
European Conference on Computer Vision (ECCV), 2018.
Oral (2.1% acceptance rate)
-
Self-Boosted Gesture Interactive System with ST-Net
Zhengzhe Liu*, Xiaojuan Qi*, Lei Pang.
ACM Multimedia Conference (ACM MM), 2018.
Full Research Paper
-
GeoNet: Geometric Neural Network for Joint Depth and Surface Normal Estimation
Xiaojuan Qi, Renjie Liao, Zhengzhe Liu, Raquel Urtasun, Jiaya Jia
IEEE Conference on Computer Vision and Pattern Recognition(CVPR), 2018.
[Code][Training data]
-
Semi-parametric Image Synthesis
Xiaojuan Qi, Qifeng Chen, Jiaya Jia, Vladlen Koltun
IEEE Conference on Computer Vision and Pattern Recognition(CVPR), 2018.
Oral (2.1% acceptance rate)
[Code][Video][Supplement]
-
Referring Image Segmentation via Recurrent Refinement Networks
Ruiyu Li, Kaican Li, Yi-Chun Kuo, Michelle Shu, Xiaojuan Qi, Xiaoyong Shen, Jiaya Jia.
IEEE Conference on Computer Vision and Pattern Recognition(CVPR), 2018.
-
3D Graph Neural Networks for RGBD Semantic Segmentation
Xiaojuan Qi, Renjie Liao, Jiaya Jia, Sanja Fidler, Raquel Urtasun
IEEE International Conference on Computer Vision (ICCV), 2017
Oral (2.1% acceptance rate)
[Code]
-
Pyramid Scene Parsing Network
Hengshuang Zhao, Jianping Shi, Xiaojuan Qi, Xiaogang Wang, Jiaya Jia
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2017.
Winner in ImageNet Scene Parsing Challenge 2016
[Project & Code]
-
Augmented Feedback in Semantic Segmentation under Image Level Supervision
Xiaojuan Qi, Zhengzhe Liu, Jianping Shi, Jiaya Jia.
European Conference on Computer Vision (ECCV), 2016.
-
DCAN: Deep Contour-Aware Networks for Accurate Gland Segmentation
Hao Chen, Xiaojuan Qi, Lequan Yu , Pheng-Ann Heng.
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2016.
-
Multi-scale Patch Aggregation (MPA) for Simultaneous Detection and Segmentation
Shu Liu, Xiaojuan Qi, Jianping Shi, Jiaya Jia
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2016
Oral (3.9% acceptance rate)
-
Deep Contextual Networks for Neuronal Structure Segmentation
Hao Chen*, Xiaojuan Qi*, Jie-Zhi Cheng, Pheng-Ann Heng.
Association for the Advancement of Artificial Intelligence (AAAI), 2016
Oral
-
Semantic Segmentation with Object Clique Potential
Xiaojuan Qi, Jianping Shi, Shu Liu, Renjie Liao, Jiaya Jia
IEEE International Conference on Computer Vision (ICCV), 2015
Honors and Awards
Full Oral presentations (acceptance rate about 2%-4%) at ECCV'18, CVPR'18, ICCV'17, CVPR'16, AAAI'16.
Outstanding Reviewer Award at ICCV 2019.
CVPR'18 Doctoral Consortium Travel Award.
Outstanding Reviewer Award at ICCV 2017.
Certificate of Merit for Best TA (Fall 2016 - 2017).
Hong Kong PhD Fellowship Award (200 candidates in Hong Kong), 2014 - 2018.
1st Place Winner at the ImageNet Scene Parsing Challenge, 2016.
1st Place Winner at MICCAI Gland Segmentation Challenge, 2015.
Professional Activities
- Program Committees:
Area Chair for NeurIPS 2023.
Area Chair for CVPR 2023.
Area Chair for WACV 2023.
Senior Program Committee Member for AAAI 2023.
Area Chair for AAAI 2022.
Area Chair for ICCV 2021.
Area Chair for CVPR 2021.
Area Chair for AAAI 2021.
Senior Program Committee Member for AAAI 2020.
- Conference Review:
European Conference on Computer Vision (ECCV) 2020.
Neural Information Systems Processing Conference (NIPS) 2020.
International Conference on Computer Vision and Pattern Recognition (CVPR) 2020.
Internation Conference on Learning Representations (ICLR) 2020.
International Conference on Computer Vision (ICCV) 2019.
British Machine Vision Conference (BMVC) 2019.
International Conference on Computer Vision and Pattern Recognition (CVPR) 2019.
International Joint Conference on Artificial Intelligence (IJCAI) 2019.
European Conference on Computer Vision (ECCV) 2018.
International Conference on Computer Vision and Pattern Recognition (CVPR) 2018.
Neural Information Systems Processing Conference (NIPS) 2018.
Asian Conference on Computer Vision (ACCV) 2018.
International Joint Conference on Artificial Intelligence (IJCAI) 2018.
International Conference on Computer Vision (ICCV) 2017.
- Journal Review:
Nature Machine Intelligence.
International Journal on Computer Vision (IJCV).
IEEE Transactions on Pattern Analysis and Machine Intelligence (PAMI).
IEEE Transaction on Image Processing (TIP).
IEEE Transaction on knowledge and Data Engineering (TKDE).
ACM Transaction on Intelligent Systems and Technology (ACM TIST).
Pattern Recognition (PR).
Medical Image Analysis (MedIA).
IEEE Transaction on Medical Imaging (TMI).
Teaching
| CSCI 4190 Introduction to Social Networks | Fall | 2016-2017 |
| ENGG 5104 Image Processing and Computer Vision (Certificate of Merit for Best TA) | Fall | 2016-2017 |
| ENGG 2601A Technology, Society and Engineering Practice | Spring | 2016-2017 |
| CSCI 3290 Computational Photography | Fall | 2015-2016 |
| ENGG 2120 Digital Logic and Systems | Fall | 2014-2015 |