Photo

我目前是剑桥大学计算机科学与技术系的博士生(Ph.D. candidate), 师从 Rafal Mantiuk 教授。 2023年, 我在 复旦大学 获得我的工学学士学位, 专业为智能科学与技术。 2022年, 我在斯坦福大学担任科研助理 - 斯坦福视觉与学习实验室 , 在 Jiajun WuYunzhu Li教授的指导下研究。 在此之前, 我于2021~2023年在复旦大学担任科研助理, 受到 Tao Chen 教授的指导。 此外, 我近期还曾在字节跳动 (ByteDance) 美国参与开发 Vidi-Gen, 并在 LG Electronics 美国计算摄影团队担任研究科学家实习生。

我对计算机视觉、计算机图形学、多模态大语言模型 (Multimodal LLM) 以及视频生成领域非常感兴趣。 我的博士研究致力于将人类视觉系统的洞见与前沿机器学习技术相结合,建立稳健的计算模型来评估显示图像与视频质量。 近期,我的研究兴趣进一步延伸到了多模态大语言模型与长视频生成领域,这也是我目前正在积极探索的方向。

邮箱: yc613 [at] cam [dot] ac [dot] uk & cycxueshu [at] 163 [dot] com
微信: cyc13700232963
OpenReview / GitHub / 知乎Zhihu /


新消息



教育经历

剑桥大学
计算机科学与技术部门
博士生

2023年10月 - 至今 (预计2027年毕业)
斯坦福大学
计算机科学部门
无学位制本科生
科研助理 (UVRI 实习生)

2022年1月 - 2023年6月
复旦大学
智能科学与技术(卓越班)
本科生, 获得工学学士学位
绩点: 3.92/4.0; 排名: 1/245

2019年9月 - 2023年6月


发表文章

(* indicates equal contribution)

Yancheng Cai, Robert Wanat, Rafał K. Mantiuk
CameraVDP: Perceptual Display Assessment with Uncertainty Estimation via Camera and Visual Difference Prediction
SIGGRAPH Asia 2025, Published
[DOI] [Paper] [Arxiv] [Project]
Yancheng Cai, Fei Yin, Dounia Hammou, Rafał K. Mantiuk
Do computer vision foundation models learn the low-level characteristics of the human visual system?
CVPR 2025, Published - Highlight (Top 2% of submissions)
[Paper] [Project] [Code] [Results]
Yancheng Cai, Ali Bozorgian, Maliha Ashraf, Robert Wanat, Rafał K. Mantiuk
elaTCSF: A Temporal Contrast Sensitivity Function for Flicker Detection and Modeling Variable Refresh Rate Flicker
SIGGRAPH Asia 2024, Published (With Strong Accept)
[Project] [Paper]
Yancheng Cai*, Stephen Tian*, Hong-Xing Yu, Sergey Zakharov, Katherine Liu, Adrien Gaidon, Yunzhu Li, Jiajun Wu
Multi-object manipulation via object-centric neural scattering functions
CVPR 2023, Published (With two Strong Accepts)
[Project] [Paper]
Yancheng Cai, Bo Zhang, Baopu Li, Tao Chen, Hongliang Yan, Jingdong Zhang, Jiahao Xu
Rethinking Cross-Domain Pedestrian Detection: A Background-Focused Distribution Alignment Framework for Instance-free One-Stage Detectors
TIP (IEEE Transactions on Image Processing), Published
[IEEE paper] [知乎]
Dounia Hammou, Yancheng Cai, Pavan Chennagiri, Christos G. Bampis, Rafał K. Mantiuk
Evaluating quality metrics through the lenses of psychophysical measurements of low-level vision
QoMEX (International Conference on Quality of Multimedia Experience), Published - Best Student Paper Award 🏆
[arxiv]
Jingdong Zhang, Peng Ye, Bo Zhang, Hancheng Ye, Baopu Li, Yancheng Cai, Tao Chen
BridgeNet: Comprehensive and Effective Feature Interactions via Bridge Feature for Multi-Task Dense Predictions
TPAMI (IEEE Transactions on Pattern Analysis and Machine Intelligence), Published
[IEEE paper]
Lei Lu*, Yancheng Cai*, Hua Huang, Ping Wang
An efficient fine-grained vehicle recognition method based on part-level feature optimization
Neurocomputing, Published
[paper]

科研经历

字节跳动 (ByteDance) 美国
Vidi-Gen
研究科学家实习生 (Research Scientist Intern, Ph.D.)
训练面向视频理解与长篇叙事脚本/分镜生成的多模态大语言模型 Vidi-Gen, 并搭建了与 Seedance 2.0 集成的自评估多智能体视频生成系统, 用于连贯的长视频多模态合成。

2026年2月 - 至今
LG Electronics 美国
计算摄影 (Computational Photography) 团队
研究科学家实习生 (Research Scientist Intern, Ph.D.)
提出了集校准、伪影去除、色彩校正、几何校正与去模糊于一体的自动化显示屏评估流程, 广泛评估了主流 OLED 与 mini-LED 显示屏; 相关方法将纳入 2027 IDMS 标准。

2025年10月 - 2025年12月
斯坦福大学
斯坦福视觉与学习实验室
科研助理 (UVRI 实习生)
指导老师: Jiajun Wu 教授, Yunzhu Li 教授。

2022年1月 - 2023年6月
复旦大学
嵌入式深度学习与视觉分析实验室
科研助理
指导老师: Tao Chen 教授。

2020年10月 - 2023年6月


Selected Award



Academic Service