我目前是剑桥大学计算机科学与技术系的博士生(Ph.D. candidate), 师从 Rafal Mantiuk 教授。 2023年, 我在 复旦大学 获得我的工学学士学位, 专业为智能科学与技术。 2022年, 我在斯坦福大学担任科研助理 - 斯坦福视觉与学习实验室 , 在 Jiajun Wu 和 Yunzhu Li教授的指导下研究。 在此之前, 我于2021~2023年在复旦大学担任科研助理, 受到 Tao Chen 教授的指导。 此外, 我近期还曾在字节跳动 (ByteDance) 美国参与开发 Vidi-Gen, 并在 LG Electronics 美国计算摄影团队担任研究科学家实习生。
我对计算机视觉、计算机图形学、多模态大语言模型 (Multimodal LLM) 以及视频生成领域非常感兴趣。 我的博士研究致力于将人类视觉系统的洞见与前沿机器学习技术相结合,建立稳健的计算模型来评估显示图像与视频质量。 近期,我的研究兴趣进一步延伸到了多模态大语言模型与长视频生成领域,这也是我目前正在积极探索的方向。
邮箱: yc613 [at] cam [dot] ac [dot] uk & cycxueshu [at] 163 [dot] com
微信: cyc13700232963
OpenReview /
GitHub /
知乎Zhihu /