我目前在墨尔本大学理学院数学与统计系攻读博士学位,导师为宫明明教授 (Prof. Mingming Gong)。同时,我在新加坡 HeyGen 担任 AI 研究实习生,由任意 (Mr. Yi Ren) 和洪智滨 (Mr. Zhibin Hong) 指导。此前,我于 2023 年在香港中文大学(深圳)(CUHK-SZ) 获得哲学硕士学位,导师为韩晓光教授 (Prof. Xiaoguang Han);于 2021 年在清华大学 获得工学学士学位,导师为李一鹏教授 (Prof. Yipeng Li)。
我的研究方向包括生成式模型、视觉语言模型以及多模态语言模型。我已在 CVPR、ECCV、ICLR 等顶级国际 AI 会议上发表 10 余篇论文,累计Google Scholar 引用 700+ ()。
如您有意向进行任何形式的学术合作,欢迎随时通过 antonio.chan.cc@outlook.com 与我联系。
🔥 新闻
- 2026.07: 🎉 一篇论文被 SIGGRAPH Asia 2026 接收。
- 2026.06: 🎉 一篇论文被 ECCV 2026 接收。
- 2026.02: 🎉 一篇论文被 CVPR 2026 接收。
- 2026.01: 🎉 一篇论文被 ICLR 2026 接收。
- 2025.06: 🎉 加入新加坡 HeyGen 担任 AI 研究实习生!
- 2024.07: 🎉 一篇论文被 ECCV 2024 接收。
- 2023.02: 🎉 一篇论文被 CVPR 2023 接收。
📝 论文发表
* 表示同等贡献。
视频生成与理解

TransVLM: A Vision-Language Framework and Benchmark for Detecting Any Shot Transitions
Ce Chen, Yi Ren, Yuanming Li, Viktor Goriachko, Zhenhui Ye, Zujin Guo, Zhibin Hong, Mingming Gong
- 提出镜头转场检测 (STD) 任务和 TransVLM 框架,通过注入光流作为运动先验,使 VLM 能够检测视频转场的连续时间片段。
- 已在 HeyGen 部署至生产环境。

TAVR: Generate Your Talking Avatar from Video Reference
Zujin Guo, Zhenhui Ye, Yi Ren, Yuanming Li, Ce Chen, Zhibin Hong, Chen Change Loy
- 提出一种基于视频参考的跨场景数字人视频生成新框架,融合了 token 选择机制与三阶段训练策略。
- 已在 HeyGen 部署至生产环境。
Avatar V: Scaling Video-Reference Avatar Video Generation
Benjamin Liang, Ce Chen, Desmond Lin, Ivan Somov, Jiajun Zhao, Jiewei Yuan, Jingfeng Zhang, Junhao Huang, Nik Nolte, Pedram Haqiqi, Penghan Wang, Rong Yan, Rui Zhang, Sam Prokopchuk, Sivan Wang, Viktor Goriachko, Yi Ren, Yuanming Li, Yutao Chen, Zhenhui Ye, Zhibin Hong, Zilong Nie, Zujin Guo
- 一个生产级规模的视频参考驱动数字人生成框架,提出 Sparse Reference Attention 实现长参考视频的线性复杂度条件建模。
- 已在 HeyGen 部署至生产环境,在数千块 GPU 上训练,数据引擎策划超 1 亿条训练片段。
图像生成与理解

Mobile-VTON: High-Fidelity On-Device Virtual Try-On
Zhenchen Wan*, Ce Chen*, Runqi Lin, Jiaxin Huang, Tianxi Chen, Yanwu Xu, Tongliang Liu, Mingming Gong
- 一个保护隐私的虚拟试穿框架,支持在普通移动设备上完全离线运行。提出模块化 TGT 架构与特征引导对抗蒸馏策略。
- 在 VITON-HD 和 DressCode 数据集上以 1024×768 分辨率达到与服务器端方法相当甚至更优的性能。
3D/4D 生成与理解

Condition Matters in Full-Head 3D GANs
Heyuan Li, Huimin Zhang, Yuda Qiu, Zhengwentai Sun, Keru Zheng, Lingteng Qiu, Peihao Li, Qi Zuo, Ce Chen, Yujian Zheng, Yuming Gu, Zilong Dong, Xiaoguang Han
- 提出视角不变的语义特征条件建模,将 3D 头部生成能力与观察方向解耦,在全头部合成中实现更高的保真度和多样性。

CT4D: Consistent Text-to-4D Generation with Animatable Meshes
Ce Chen, Shaoli Huang, Xuelin Chen, Guangyi Chen, Xiaoguang Han, Kun Zhang, Mingming Gong
- 提出一种基于可驱动网格的全新 text-to-4D 框架,引入 Generate-Refine-Animate (GRA) 算法实现文本对齐的网格生成与一致驱动。

SphereHead: Stable 3D Full-head Synthesis with Spherical Tri-plane Representation
Heyuan Li, Ce Chen, Tianhao Shi, Yuda Qiu, Sizhe An, Guanying Chen, Xiaoguang Han
- 提出球面坐标系下的 spherical tri-plane 表示,有效缓解全头部 3D GAN 合成中的”镜像伪影”问题,并提出视角-图像一致性损失。

SCoDA: Domain Adaptive Shape Completion for Real Scans
Yushuang Wu, Zizheng Yan, Ce Chen, Lai Wei, Xiao Li, Guanbin Li, Yihao Li, Shuguang Cui, Xiaoguang Han
- 提出 SCoDA 新任务(真实扫描的域自适应形状补全)及 ScanSalon 数据集,设计了跨域特征融合模块和体积一致性自训练框架。
医学图像分析

DenseMP: Unsupervised Dense Pre-training for Few-shot Medical Image Segmentation
Zhaoxin Fan, Puquan Pan, Zeren Zhang, Ce Chen, Tianyang Wang, Siyang Zheng, Min Xu
- 提出两阶段无监督密集预训练流水线,结合分割感知的密集对比学习与超像素引导预训练,在 Abd-CT 和 Abd-MRI 数据集上达到 SOTA。
超分辨率

Structure-Preserving Super Resolution with Gradient Guidance
Cheng Ma, Yongming Rao, Yean Cheng, Ce Chen, Jiwen Lu, Jie Zhou
- 提出利用梯度图引导图像恢复的结构保持超分辨率方法,设计了梯度分支和梯度损失以施加二阶结构约束。
- 已被引用 380 余次。
🎖 荣誉与奖项
- 2026.03 🎓 墨尔本研究奖学金 (Melbourne Research Scholarship)
- 2026.03 🎓 Rowden White 奖学金 (Rowden White Scholarship)
📖 教育背景

🎓 博士研究生 (Ph.D.)
📚 理学院,数学与统计系
🏫 墨尔本大学 (University of Melbourne)
📅 2026年3月 – 至今
👨🏫 导师:宫明明教授 (Prof. Mingming Gong)

🎓 哲学硕士 (M.Phil.)
📚 理工学院,计算机与信息工程
🏫 香港中文大学(深圳)(CUHK-SZ)
📅 2021年8月 – 2023年7月
👨🏫 导师:韩晓光教授 (Prof. Xiaoguang Han) | 绩点: 3.98 / 4.0 (排名 1/32)

🎓 工学学士 (B.Eng.)
📚 自动化系
🏫 清华大学 (Tsinghua University)
📅 2017年8月 – 2021年7月
👨🏫 导师:李一鹏教授 (Prof. Yipeng Li) | 绩点: 3.44 / 4.0
💻 实习经历

💼 AI 研究实习生
🏢 HeyGen
📍 新加坡
📅 2025年6月 – 至今
📝 导师:任意 (Mr. Yi Ren)。研究基于扩散模型的精确、高质量人体视频生成。

💼 研究助理
🏢 机器学习系,穆罕默德·本·扎耶德人工智能大学 (MBZUAI)
📍 阿联酋阿布扎比
📅 2024年2月 – 2025年6月
📝 导师:宫明明教授 (Prof. Mingming Gong) 和 张坤教授 (Prof. Kun Zhang)。研究 text-to-4D 生成、端侧 text-to-image 以及虚拟试穿。

💼 研究助理
🏢 理工学院,香港中文大学(深圳)(CUHK-SZ)
📍 中国广东深圳
📅 2023年8月 – 2024年1月
📝 导师:韩晓光教授 (Prof. Xiaoguang Han)。研究基于 spherical tri-plane 表示的高保真 3D 人头生成。

💼 计算机视觉算法工程师实习生
🏢 微信事业群,腾讯 (Tencent)
📍 中国北京
📅 2021年6月 – 2021年8月
📝 开发表格识别系统,将摄像头拍摄或 PDF 截取的表格图片转换为结构化 HTML,已成为公司电子办公系统的一部分。

💼 计算机视觉算法工程师实习生
🏢 AI Lab,字节跳动 (ByteDance)
📍 中国北京
📅 2020年6月 – 2020年11月
📝 开发户型图矢量化系统,实现结构化房间解析,识别准确率超过 90%,转化效率提升 5 倍以上。
📋 学术服务
- 📖 会议审稿人:NeurIPS 2026, ECCV 2026, CVPR 2026, ICLR 2026, NeurIPS 2025
- 📖 期刊审稿人:IEEE Transactions on Multimedia, IEEE Signal Processing Letters, IEEE Transactions on Image Processing