Portrait of Honghao Fu

Honghao Fu

Ph.D. Student @ University of Queensland

Email: honghao.fu@uq.edu.au · hfu006@e.ntu.edu.sg

About Me

I am currently a first-year Ph.D. student at the School of Electrical Engineering and Computer Science, the University of Queensland, supervised by Prof. Yujun Cai, Prof. Miao Xu and Prof. Yiwei Wang. I was an Intern Researcher at StepFun, working closely with Dr. Gang Yu. Before that, I was an Intern Researcher of the AI Thrust at The Hong Kong University of Science and Technology (Guangzhou), supervised by Prof. Hao Wang. I received my M.Sc at the School of Electrical and Electronic Engineering, Nanyang Technological University, supervised by Prof. Bihan Wen and Dr. Yufei Wang. Prior to this, I obtained my B.Eng. from Southeast University.

  • Artificial Intelligence
  • Large Language Models
  • Agentic Systems
  • Multimodal Understanding

Education

  1. University of Queensland Doctor of Philosophy 2025-Now
  2. Nanyang Technological University Master of Science 2023-2025
  3. Southeast University Bachelor of Engineering 2019-2023

Work Experience

  1. StepFun Intern Researcher Mar. 2025 - Jun. 2025
  2. HKUST-GZ Intern Researcher Aug. 2023 - Feb. 2025

Services

Conference Reviewer: ICLR, NeurIPS, CVPR, ICML, ACL, ACM-MM, ICASSP, IJCNN, etc.

Journal Reviewer: IEEE Transactions on Intelligent Transportation Systems (T-ITS), IEEE Internet of Things Journal (IoT), Journal of Selected Topics in Signal Processing (JSTSP), Pattern Recognition (PR), Neural Networks, Neurocomputing, etc.

Selected Publications

VideoStir framework figure

VideoStir: Understanding Long Videos via Spatio-Temporally Structured and Intent-Aware RAG

Honghao Fu, Miao Xu, Yiwei Wang, Dailing Zhang, Jun Liu, Yujun Cai

ACL 2026 (main) Oral

ContextNav framework figure

ContextNav: Towards Agentic Multimodal In-Context Learning

Honghao Fu, Yuan Ouyang, Kai-Wei Chang, Yiwei Wang, Zi Huang, Yujun Cai

ICLR 2026

V-DEAL framework figure

V-DEAL: Diagnosing Video Safety De-Calibration as an Understanding-Refusal Coupling Failure

Zhetong Zhang, Honghao Fu, Miao Xu, Yiwei Wang, Yujun Cai

COLM 2026

WaMo framework figure

WaMo: Wavelet-Enhanced Multi-Frequency Trajectory Analysis for Fine-Grained Text-Motion Retrieval

Junlong Ren, Gangjian Zhang, Honghao Fu, Pengcheng Wu, Hao Wang

ACM-MM 2026

OmniLottie framework figure

OmniLottie: Generating Vector Animations via Parameterized Lottie Tokens

Yiying Yang, Wei Cheng, Sijin Chen, Honghao Fu, Xianfang Zeng, Yujun Cai, Gang Yu, Xingjun Ma

CVPR 2026

VistaWise framework figure

VistaWise: Building Cost-Effective Agent with Cross-Modal Knowledge Graph for Minecraft

Honghao Fu, Junlong Ren, Qi Chai, Deheng Ye, Yujun Cai, Hao Wang

EMNLP 2025 (main)

BrainVis framework figure

BrainVis: Exploring the Bridge between Brain and Visual Signals via Image Reconstruction

Honghao Fu, Hao Wang, Jing-Jih Chin, Zhiqi Shen

ICASSP 2025

SDR-GAIN framework figure

SDR-GAIN: A High Real-Time Occluded Pedestrian Pose Completion Method for Autonomous Driving

Honghao Fu, Yongli Gu, Yidong Yan, Yilang Shen, Yiwen Wu, Libo Sun

IEEE Trans. ITS, 2025

DP-IQA framework figure

DP-IQA: Utilizing Diffusion Prior for Blind Image Quality Assessment in the Wild

Honghao Fu, Yufei Wang, Wenhan Yang, Alex C. Kot, Bihan Wen

ArXiv 2024 Under Review

Technical Report

ShopX preview figure

ShopX: A Foundation Model for Intent-to-Item Fulfillment in Agentic Shopping

ShopX Team, Alibaba Group

Technical Report, 2026

Step1X-Edit framework figure

Step1X-Edit: A Practical Framework for General Image Editing

Step1X-Image Team, StepFun

Technical Report, 2025

Full Publication List

  1. Honghao Fu, Miao Xu, Yiwei Wang, Dailing Zhang, Jun Liu, and Yujun Cai. (2026). VideoStir: Understanding Long Videos via Spatio-Temporally Structured and Intent-Aware RAG. ACL 2026 Main. (Oral, Top 0.8%) [Paper]
  2. Honghao Fu, Yuan Ouyang, Kai-Wei Chang, Yiwei Wang, Zi Huang, and Yujun Cai. (2026). ContextNav: Towards Agentic Multimodal In-Context Learning. ICLR 2026. [Paper]
  3. Zhetong Zhang, Honghao Fu, Miao Xu, Yiwei Wang, and Yujun Cai. (2026). V-DEAL: Diagnosing Video Safety De-Calibration as an Understanding-Refusal Coupling Failure. COLM 2026. [Paper]
  4. Junlong Ren, Gangjian Zhang, Honghao Fu, Pengcheng Wu, and Hao Wang. (2026). WaMo: Wavelet-Enhanced Multi-Frequency Trajectory Analysis for Fine-Grained Text-Motion Retrieval. ACM-MM 2026. [Paper]
  5. Yiying Yang, Wei Cheng, Sijin Chen, Honghao Fu, Xianfang Zeng, Yujun Cai, Gang Yu, and Xingjun Ma. (2026). OmniLottie: Generating Vector Animations via Parameterized Lottie Tokens. CVPR 2026. [Paper]
  6. Jiacheng Chen, Tao Zhang, Manxi Lin, Dunxian Huang, Teng Shi, Honghao Fu, Mengyan Li, Xinming Zhang, Chenchi Zhang, Xuan Lu, Xiaotong Du, et al. (2026). ShopX: A Foundation Model for Intent-to-Item Fulfillment in Agentic Shopping. arXiv:2606.31693. (Technical Report) [Paper]
  7. Honghao Fu, Junlong Ren, Qi Chai, Deheng Ye, Yujun Cai, and Hao Wang. (2025). VistaWise: Building Cost-Effective Agent with Cross-Modal Knowledge Graph for Minecraft. EMNLP 2025 Main. [Paper]
  8. Honghao Fu, Zhiqi Shen, Jing Jih Chin, and Hao Wang. (2025). BrainVis: Exploring the Bridge between Brain and Visual Signals via Image Reconstruction. ICASSP 2025. [Paper]
  9. Honghao Fu, Yongli Gu, Yidong Yan, Yilang Shen, Yiwen Wu, and Libo Sun. (2025). SDR-GAIN: A High Real-Time Occluded Pedestrian Pose Completion Method for Autonomous Driving. IEEE Transactions on Intelligent Transportation Systems, 2025 (IF=8.4). [Paper]
  10. Yongli Gu, Xiang Yan, Hanlin Qin, Naveed Akhtar, Shuai Yuan, Honghao Fu, Shuowen Yang, and Ajmal Mian. (2025). HDTCNet: A hybrid-dimensional convolutional network for multivariate time series classification. Pattern Recognition, 2025 (IF=7.5). [Paper]
  11. Shiyu Liu, Yucheng Han, Peng Xing, Fukun Yin, Rui Wang, Wei Cheng, Jiaqi Liao, Yingming Wang, Honghao Fu, ..., Gang Yu, and Daxin Jiang. (2025). Step1X-Edit: A Practical Framework for General Image Editing. arXiv:2504.17761. (Technical Report) [Paper]
  12. Honghao Fu, Yufei Wang, Wenhan Yang, and Bihan Wen. (2024). DP-IQA: Utilizing Diffusion Prior for Blind Image Quality Assessment in the Wild. arXiv preprint arXiv:2405.19996. (Under Review) [Paper]
  13. Honghao Fu, Yilang Shen, Yuxuan Liu, Jingzhong Li, and Xiang Zhang. (2023). SGCN: A multi-order neighborhood feature fusion landform classification method based on superpixel and graph convolutional network. International Journal of Applied Earth Observation and Geoinformation, 2023 (IF=8.6). [Paper]

BibTeX