This page presents a selection of my publications.
For a complete and up-to-date list, please visit my
Google Scholar profile.
IntentQA: Intent Question Answering in Videos by Cognitive Context Reasoning
Jiapeng Li
Ping Wei✉
Wenjuan Han
Song-Chun Zhu
Lifeng Fan✉
IEEE Transactions on Pattern Analysis and Machine Intelligence, 2026.
Paper
ICCV version
Supp
Dataset
Demo
PureSpace: A Benchmark for Abstract Spatial Reasoning in Vision-Language Models
Jinkai Li
Zhenliang Zhang
Lifeng Fan✉
Wei Wang✉
CVPR Findings, 2026.
Paper (coming)
Read the Room: Video Social Reasoning with Mental-Physical Causal Chains
Lixing Niu
Jiapeng Li
Xingping Yu
Xinyi Dong
Shu Wang
Ruining Feng
Bo Wu
Ping Wei
Yisen Wang
Lifeng Fan✉
International Conference on Learning Representations (ICLR), 2026.
Paper
Arxiv Version
Learning Concept-Based Causal Transition and Symbolic Reasoning for Visual Planning
Yilue Qian
Peiyu Yu
Yingnian Wu
Yao Su
Wei Wang✉
Lifeng Fan✉
IEEE/RSJ International Conference on Intelligent Robots and Systems (IROS), 2024
Arxiv
Paper
Evaluating and Modeling Social Intelligence: A Comparative Study of Human and AI Capabilities
Junqi Wang*
Chunhui Zhang*
Jiapeng Li
Yuxi Ma
Lixing Niu
Jiaheng Han
Yujia Peng✉
Yixin Zhu✉
Lifeng Fan✉
Proceedings of the Annual Meeting of the Cognitive Science Society (CogSci), 2024
Paper
Demo
Code & Dataset
Appendix
Smart Help: Strategic Opponent Modeling for Proactive and Adaptive Robot Assistance in Households
Zhihao Cao*
Zidong Wang*
Siwen Xie
Anji Liu
Lifeng Fan✉
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2024.
Paper
Code
Data & Model
Demo
Poster
Artificial Social Intelligence: A Comparative and Holistic View
Lifeng Fan
Manjie Xu
Zhihao Cao
Yixin Zhu✉
Song-Chun Zhu✉
CAAI Artificial Intelligence Research, 2022.
Paper
中国科学报/科学网1
中国科学报/科学网2
北大新闻网
北大AI院官网
北大科研官微
北大新工科官微
北大AI院官微
Learning Triadic Belief Dynamics in Nonverbal Communication from Videos
Lifeng Fan*
Shuwen Qiu*
Zilong Zheng
Tao Gao
Song-Chun Zhu
Yixin Zhu✉
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2021.
Paper
Supp
Code
Dataset
Demo
Oral
MIT科技评论
DeepTech
Understanding Human Gaze Communication by Spatio-Temporal Graph Reasoning
Lifeng Fan*
Wenguan Wang*
Siyuan Huang
Xinyu Tang
Song-Chun Zhu✉
The IEEE International Conference on Computer Vision (ICCV), 2019.
Paper
Code
Dataset
Demo
Inferring Shared Attention in Social Scene Videos
Lifeng Fan*
Yixin Chen*
Ping Wei✉
Wenguan Wang
Song-Chun Zhu
IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 2018.
Paper
Code
Dataset
Demo