Yinming Huang 「黄音铭」

| Github | Email | Google Scholar |

I am a first-year Ph.D. student at Fudan University, jointly trained with Shanghai Innovation Institute, under the supervision of Prof. Zuxuan Wu. I also work closely with Shuyuan Tu. Prior to that, I received my B.Eng. degree in Artificial Intelligence from Fudan University in 2026.

My research focuses on reinforcement learning for video generation and agentic visual generation. I am particularly interested in building generative models that learn from external feedback and developing agentic frameworks that enable them to adapt and improve over time through interaction.

Email: 26113050052 [AT] m.fudan.edu.cn


Education

Fudan University
B.Eng. in Artificial Intelligence
Sep. 2022 – Jun. 2026

Honors & Awards
  • Outstanding Graduate of Fudan University, 2026
  • First-Class Scholarship for Outstanding Undergraduate Students, Fudan University, 2023-2024
  • First-Class Scholarship for Outstanding Undergraduate Students, Fudan University, 2022-2023
  • First Prize in the Preliminary Round of the Chinese Mathematical Olympiad (2021)
Experience

2030 Lab, Yinwang Intelligent Technology Co., Ltd.
Research Intern
Dec. 2025 – Aug. 2026

University of California, San Diego (UCSD)
Exchange Student
Sep. 2024 – Dec. 2024


  Publications
VA-Judger training pipeline

VA-Judger: Reward Modeling from Human Preference Feedback for Joint Video-Audio Generation Star
Yinming Huang*, Shuyuan Tu*, Xi Yan, Zihan Yang, Jianhua Han, Hang Xu, Kaihang Pan, Yu-Gang Jiang, Zuxuan Wu

webpage | abstract | bibtex | arXiv | code | checkpoints | dataset | YouTube | Bilibili |
@article{huang2026vajudger,
  title={VA-Judger: Reward Modeling from Human Preference Feedback for Joint Video-Audio Generation},
  author={Huang, Yinming and Tu, Shuyuan and Yan, Xi and Yang, Zihan and Han, Jianhua and Xu, Hang and Pan, Kaihang and Jiang, Yu-Gang and Wu, Zuxuan},
  journal={arXiv preprint arXiv:2608.18607},
  year={2026}
}
sym

[CVPR 2026] FlashPortrait: 6$\times$ Faster Infinite Portrait Animation with Adaptive Latent Prediction Star
Shuyuan Tu, Yueming Pan, Yinming Huang, Xintong Han, Zhen Xing, Qi Dai, Kai Qiu, Chong Luo, Zuxuan Wu, Yu-Gang Jiang

webpage | abstract | bibtex | arXiv | code | YouTube | Bilibili |
@article{tu2025flashportrait,
  title={FlashPortrait: 6$\times$ Faster Infinite Portrait Animation with Adaptive Latent Prediction},
  author={Tu, Shuyuan and Pan, Yueming and Huang, Yinming and Han, Xintong and Xing, Zhen and Dai, Qi and Qiu, Kai and Luo, Chong and Wu, Zuxuan},
  journal={arXiv preprint arXiv:2512.16900},
  year={2025}
}
sym

StableAvatar: Infinite-Length Audio-Driven Avatar Video Generation Star
Shuyuan Tu, Yueming Pan, Yinming Huang, Xintong Han, Zhen Xing, Qi Dai, Chong Luo, Zuxuan Wu, Yu-Gang Jiang

webpage | abstract | bibtex | arXiv | code | YouTube | Bilibili | 机器之心 | online demo
@article{tu2025stableavatar,
  title={Stableavatar: Infinite-length audio-driven avatar video generation},
  author={Tu, Shuyuan and Pan, Yueming and Huang, Yinming and Han, Xintong and Xing, Zhen and Dai, Qi and Luo, Chong and Wu, Zuxuan and Jiang, Yu-Gang},
  journal={arXiv preprint arXiv:2508.08248},
  year={2025}
}

Website template from here and here