Publications (since 2020)

Source and full list Google Scholar. Underlined students are advised by Dr. Fan.

2026

  1. OpenLongTail: Generative Scaling of Long-Tail Driving Data
    Lulin Liu, Nuo Chen, Yan Wang, Bangya Liu, Wenyan Cong, Hezhen Hu, Boris Ivanovic, Hao Wang, Ziyao Zeng, Xinyu Gong, Yang Zhou, Zixiang Xiong, Dilin Wang, Zhangyang Wang, Weisong Shi, Ruohan Zhang, Marco Pavone, Zhiwen Fan · Preprint, 2026
  2. Disentangling Task-Relevant Latent Dynamics for Reward Modeling
    Dayou Li, Jionghao Wang, Peihao Wang, Jiuzhou Lei, Hao Wang, Hezhen Hu, Minghui Zheng, Zhangyang Wang, Xin Li, Wenping Wang, Zhiwen Fan · Preprint, 2026
  3. Can Induced Emotion Bias LLM Behaviors in Sequential Decision Making?
    Minh Khoi Ho, Zihao Zhu, Runchuan Zhu, Levina Li, Zhiwen Fan, Zhangyang Wang, Junyuan Hong · COLM, 2026
  4. EndoMD-SLAM: Endoscopic Gaussian Splatting SLAM under Optical Degradation with Memory and Static-Transient Decomposition
    Nuo Chen, Kangqi Ni, Lulin Liu, Joga Ivatury, Ying Ding, Farshid Alambeigi, Tianlong Chen, Zhiwen Fan · IROS, 2026
  5. Behavior Uncloning: Distilling Mode Redirection into Policy Weights without Inference-Time Steering
    Hao Wang, Jiuzhou Lei, Dayou Li, Bangya Liu, Minghui Zheng, Manling Li, Ruohan Zhang, Zhiwen Fan · Preprint, 2026
  6. A Physics-Grounded Benchmark for Multi-Agent Dynamics in World Models
    Nuo Chen, Lulin Liu, Zihao Li, Ziyao Zeng, Zihao Zhu, Wenyan Cong, Junyuan Hong, Yunhao Yang, Zhengzhong Tu, Yan Wang, Boris Ivanovic, Marco Pavone, Zhangyang Wang, Yang Zhou, Zhiwen Fan · ECCV, 2026
  7. Trust It or Not: Evidential Uncertainty for Feed-Forward 3D Reconstruction with Trust3R
    Zihao Zhu, Wenyuan Zhao, Nuo Chen, Chao Tian, Zhiwen Fan · ICML, 2026
  8. FF3R: Feedforward Feature 3D Reconstruction from Unconstrained Views
    Chaoyi Zhou, Run Wang, Feng Luo, Mert D. Pese, Zhiwen Fan, Yiqi Zhong, Siyu Huang · CVPR Findings, 2026
  9. EgoTL: Egocentric Think-Aloud Chains for Long-Horizon Tasks
    Lulin Liu, Dayou Li, Yiqing Liang, Sicong Jiang, Hitesh Vijay, Hezhen Hu, Xuhai Xu, Zirui Liu, Srinivas Shakkottai, Manling Li, Zhiwen Fan · CVPR Findings, 2026
  10. Accelerating Transformer-Based Monocular SLAM via Geometric Utility Scoring
    Xinmiao Xiong, Bangya Liu, Hao Wang, Dayou Li, Nuo Chen, Andrew Feng, Mingyu Ding, Suman Banerjee, Yang Zhou, Zhiwen Fan · IROS, 2026
  11. How Independent are Large Language Models? A Statistical Framework for Auditing Behavioral Entanglement and Reweighting Verifier Ensembles
    Chenchen Kuai, Jiwan Jiang, Zihao Zhu, Hao Wang, Keshu Wu, Zihao Li, Yunlong Zhang, Chenxi Liu, Zhengzhong Tu, Zhiwen Fan, Yang Zhou · COLM, 2026
  12. SpatialStack: Layered Geometry-Language Fusion for 3D VLM Spatial Reasoning
    Jian Zhang, Shijie Zhou, Bangya Liu, Achuta Kadambi, Zhiwen Fan · CVPR, 2026
  13. NavTrust: Benchmarking Trustworthiness for Embodied Navigation
    Huaide Jiang, Yash Chaudhary, Yuping Wang, Zehao Wang, Raghav Sharma, Manan Mehta, Yang Zhou, Lichao Sun, Zhiwen Fan, Zhengzhong Tu, Jiachen Li · IROS, 2026
  14. NanoGS: Training-Free Gaussian Splat Simplification
    Butian Xiong, Rong Liu, Tiantian Zhou, Meida Chen, Zhiwen Fan, Andrew Feng · ECCV, 2026
  15. Egocentric World Model for Photorealistic Hand-Object Interaction Synthesis
    Dayou Li, Lulin Liu, Bangya Liu, Shijie Zhou, Jiu Feng, Ziqi Lu, Minghui Zheng, Chenyu You, Zhiwen Fan · ECCV, 2026
  16. HumanNOVA: Photorealistic, Universal and Rapid 3D Human Avatar Modeling from a Single Image
    Hezhen Hu, Wangbo Zhao, Lanqing Guo, Hanwen Jiang, Jonathan C. Liu, Zhiwen Fan, Kai Wang, Zhangyang Wang, Georgios Pavlakos · CVPR Highlight, 2026
  17. AD-VF: LLM-Automatic Differentiation Enables Fine-Tuning-Free Robot Planning from Formal Methods Feedback
    Yunhao Yang, Junyuan Hong, Gabriel Jacob Perin, Zhiwen Fan, Li Yin, Zhangyang Wang, Ufuk Topcu · ICRA, 2026
  18. VLM-3R: Vision-Language Models Augmented with Instruction-Aligned 3D Reconstruction
    Zhiwen Fan, Jian Zhang, Renjie Li, Junge Zhang, Runjin Chen, Hezhen Hu, Kevin Wang, Huaizhi Qu, Dilin Wang, Zhicheng Yan, Hongyu Xu, Justin Theiss, Tianlong Chen, Jiachen Li, Zhengzhong Tu, Zhangyang Wang, Rakesh Ranjan · CVPR, 2026

2025

  1. DynamicVerse: A Physically-Aware Multimodal Framework for 4D World Modeling
    Kairun Wen, Yuzhi Huang, Runyu Chen, Hui Zheng, Yunlong Lin, Panwang Pan, Chenxin Li, Wenyan Cong, Jian Zhang, Junbin Lu, Chenguo Lin, Dilin Wang, Zhicheng Yan, Hongyu Xu, Justin Theiss, Yue Huang, Xinghao Ding, Rakesh Ranjan, Zhiwen Fan · NeurIPS, 2025
  2. Martian World Models: Controllable Video Synthesis with Physically Accurate 3D Reconstructions
    Longfei Li, Zhiwen Fan, Wenyan Cong, Xinhang Liu, Yuyang Yin, Matt Foutter, Panwang Pan, Chenyu You, Yue Wang, Zhangyang Wang, Yao Zhao, Marco Pavone, Yunchao Wei · NeurIPS Datasets & Benchmarks, 2025
  3. CryoFastAR: Fast Cryo-EM Ab Initio Reconstruction Made Easy
    Jiakai Zhang, Shouchen Zhou, Haizhao Dai, Xinhang Liu, Peihao Wang, Zhiwen Fan, Yuan Pei, Jingyi Yu · ICCV, 2025
  4. Can Test-Time Scaling Improve World Foundation Model?
    Wenyan Cong, Hanqing Zhu, Peihao Wang, Bangya Liu, Dejia Xu, Kevin Wang, David Z. Pan, Yan Wang, Zhiwen Fan, Zhangyang Wang · COLM, 2025
  5. X2-Gaussian: 4D Radiative Gaussian Splatting for Continuous-Time Tomographic Reconstruction
    Weihao Yu, Yuanhao Cai, Ruyi Zha, Zhiwen Fan, Chenxin Li, Yixuan Yuan · ICCV, 2025
  6. VideoLifter: Lifting Videos to 3D with Fast Hierarchical Stereo Alignment
    Wenyan Cong, Hanqing Zhu, Kevin Wang, Jiahui Lei, Colton Stearns, Yuanhao Cai, Dilin Wang, Rakesh Ranjan, Matt Feiszli, Leonidas Guibas, Zhangyang Wang, Weiyao Wang, Zhiwen Fan · 3DV, CVPR Workshop Best Paper, 2025
  7. Steepest Descent Density Control for Compact 3D Gaussian Splatting
    Peihao Wang, Yuehao Wang, Dilin Wang, Sreyas Mohan, Zhiwen Fan, Lemeng Wu, Ruisi Cai, Yu-Ying Yeh, Zhangyang Wang, Qiang Liu, Rakesh Ranjan · CVPR, 2025
  8. Feature4X: Bridging Any Monocular Video to 4D Agentic AI with Versatile Gaussian Feature Fields
    Shijie Zhou, Hui Ren, Yijia Weng, Shuwang Zhang, Zhen Wang, Dejia Xu, Zhiwen Fan, Suya You, Zhangyang Wang, Leonidas Guibas, Achuta Kadambi · CVPR, 2025

2024

  1. Large Spatial Model: End-to-end Unposed Images to Semantic 3D
    Zhiwen Fan, Jian Zhang, Wenyan Cong, Peihao Wang, Renjie Li, Kairun Wen, Shijie Zhou, Achuta Kadambi, Zhangyang Wang, Danfei Xu, Boris Ivanovic, Marco Pavone, Yue Wang · NeurIPS , 2024
  2. Symbolic visual reinforcement learning: A scalable framework with object-level abstraction and differentiable expression search
    W Zheng, SP Sharan, Z Fan, K Wang, Y Xi, Z Wang · IEEE Transactions on Pattern Analysis and Machine Intelligence , 2024
  3. Expressive Gaussian Human Avatars from Monocular RGB Video
    H Hu, Z Fan, T Wu, Y Xi, S Lee, G Pavlakos, Z Wang · NeurIPS , 2024
  4. 4k4dgen: Panoramic 4d generation at 4k resolution
    Renjie Li, Panwang Pan, Bangbang Yang, Dejia Xu, Shijie Zhou, Xuanyang Zhang, Zeming Li, Achuta Kadambi, Zhangyang Wang, Zhengzhong Tu, Zhiwen Fan · ICLR , 2024
  5. DreamScene360: Unconstrained Text-to-3D Scene Generation with Panoramic Gaussian Splatting
    Shijie* Zhou, Zhiwen* Fan, Dejia* Xu, Haoran Chang, Pradyumna Chari, Tejas Bharadwaj, Suya You, Zhangyang Wang, Achuta Kadambi · ECCV , 2024
  6. MM3DGS SLAM: Multi-modal 3D Gaussian Splatting for SLAM Using Vision, Depth, and Inertial Measurements
    LC Sun, NP Bhatt, JC Liu, Z Fan, Z Wang, TE Humphreys, U Topcu · IROS , 2024
  7. Learning to estimate 6dof pose from limited data: A few-shot, generalizable approach using rgb images
    P Pan, Z Fan✉, BY Feng, P Wang, C Li, Z Wang · 3DV , 2024
  8. Lift3D: Zero-Shot Lifting of Any 2D Vision Model to 3D
    M Varma T, P Wang, Z Fan, Z Wang, H Su, R Ramamoorthi · CVPR , 2024
  9. NeRF as Pretraining at Scale: Generalizable 3D-Aware Semantic Representation Learning from View Prediction
    W Cong, H Liang, Z Fan, P Wang, Y Jiang, D Xu, AC Oztireli, Z Wang · ICCV , 2024
  10. Taming mode collapse in score distillation for text-to-3d generation
    Peihao Wang, Dejia Xu, Zhiwen Fan, Dilin Wang, Sreyas Mohan, Forrest Iandola, Rakesh Ranjan, Yilei Li, Qiang Liu, Zhangyang Wang, Vikas Chandra · CVPR , 2024
  11. Feature 3dgs: Supercharging 3d gaussian splatting to enable distilled feature fields
    Shijie Zhou, Haoran Chang, Sicheng Jiang, Zhiwen Fan, Zehao Zhu, Dejia Xu, Pradyumna Chari, Suya You, Zhangyang Wang, Achuta Kadambi · CVPR , 2024
  12. Lightgaussian: Unbounded 3d gaussian compression with 15x reduction and 200+ fps
    Z Fan, K Wang, K Wen, Z Zhu, D Xu, Z Wang · NeurIPS , 2024
  13. Pope: 6-dof promptable pose estimation of any object in any scene with one reference
    Z Fan, P Pan, P Wang, Y Jiang, D Xu, Z Wang · CVPR Workshop , 2024

2023

  1. Steindreamer: Variance reduction for text-to-3d score distillation via stein identity
    Peihao Wang, Zhiwen Fan, Dejia Xu, Dilin Wang, Sreyas Mohan, Forrest Iandola, Rakesh Ranjan, Yilei Li, Qiang Liu, Zhangyang Wang, Vikas Chandra · AISTATS , 2023
  2. Fsgs: Real-time few-shot view synthesis using gaussian splatting
    Z Zhu*, Z Fan*, Y Jiang, Z Wang · ECCV , 2023
  3. INR-Arch: A dataflow architecture and compiler for arbitrary-order gradient computations in implicit neural representation processing
    S Abi-Karam, R Sarkar, D Xu, Z Fan, Z Wang, C Hao · ICCAD , 2023
  4. Edge-moe: Memory-efficient multi-task vision transformer architecture with task-level sparsity via mixture-of-experts
    R Sarkar, H Liang, Z Fan, Z Wang, C Hao · ICCAD , 2023
  5. Data-model-circuit tri-design for ultra-light video intelligence on edge devices
    Yimeng Zhang, Akshay Karkal Kamath, Qiucheng Wu, Zhiwen Fan, Wuyang Chen, Zhangyang Wang, Shiyu Chang, Sijia Liu, Cong Hao · Proceedings of the 28th Asia and South Pacific Design Automation Conference … , 2023
  6. Enhancing nerf akin to enhancing llms: Generalizable nerf transformer with mixture-of-view-experts
    W Cong, H Liang, P Wang, Z Fan, T Chen, M Varma, Y Wang, Z Wang · ICCV , 2023
  7. Steganerf: Embedding invisible information within neural radiance fields
    C Li*, BY Feng*, Z Fan*, P Pan, Z Wang · ICCV , 2023
  8. Neurallift-360: Lifting an in-the-wild 2d photo to a 3d object with 360deg views
    D Xu, Y Jiang, P Wang, Z Fan, Y Wang, Z Wang · CVPR , 2023
  9. NeRF-SOS: Any-View Self-supervised Object Segmentation on Complex Scenes
    Z Fan, P Wang, Y Jiang, X Gong, D Xu, Z Wang · ICLR , 2023

2022

  1. Signal processing for implicit neural representations
    D Xu, P Wang, Y Jiang, Z Fan, Z Wang · NeurIPS , 2022
  2. Point cloud domain adaptation via masked local 3d structure prediction
    H Liang, H Fan, Z Fan, Y Wang, T Chen, Y Cheng, Z Wang · ECCV , 2022
  3. Unified implicit neural stylization
    Z Fan, Y Jiang, P Wang, X Gong, D Xu, Z Wang · ECCV , 2022
  4. Sinnerf: Training neural radiance fields on complex scenes from a single image
    D Xu, Y Jiang, P Wang, Z Fan, H Shi, Z Wang · ECCV , 2022
  5. M³vit: Mixture-of-experts vision transformer for efficient multi-task learning with model-accelerator co-design
    Z Fan, R Sarkar, Z Jiang, T Chen, K Zou, Y Cheng, C Hao, Z Wang · NeurIPS , 2022
  6. Aug-nerf: Training stronger neural radiance fields with triple-level physically-grounded augmentations
    T Chen, P Wang, Z Fan, Z Wang · CVPR , 2022
  7. Cadtransformer: Panoptic symbol spotting transformer for cad drawings
    Z Fan, T Chen, P Wang, Z Wang · CVPR , 2022

2021

  1. Meshmvs: multi-view stereo guided mesh reconstruction
    R Shrestha, Z Fan, Q Su, Z Dai, S Zhu, P Tan · 2021 International Conference on 3D Vision (3DV), 1290-1300 , 2021
  2. Floorplancad: A large-scale cad drawing dataset for panoptic symbol spotting
    Z Fan, L Zhu, H Li, X Chen, S Zhu, P Tan · ICCV , 2021

2020

  1. A deep error correction network for compressed sensing MRI
    L Sun, Y Wu, Z Fan, X Ding, Y Huang, J Paisley · BMC Biomedical Engineering 2 (1), 4 , 2020
  2. Cascade Cost Volume for High-Resolution Multi-View Stereo and Stereo Matching
    X Gu*, Z Fan*, S Zhu, Z Dai, F Tan, P Tan · CVPR , 2020