国奖琅琊榜---姚劲枫

Author:Time:2026-09-21Hits:

我是电子信息与通信学院2023级博士姚劲枫。 博士期间,我以第一作者或共同第一作者发表论文8篇(2篇为共一),涵盖了CVPR, NeurIPS,ECCV,AAAI等顶级计算机视觉和人工智能会议,以及Nature旗下的的npj Digital Medicine,Information Fusion等影响因子在17以上的顶级期刊。个人学术引用954次,h-index 为12。单篇最高引用418次。我完成10项第一发明人专利申请,其中2项已经授权。第一作者开源项目累计获得3600余个Star。 我的代表工作VA-VAE在CVPR 2025以满分被接收,被评选为Oral 展示,并进入CVPR 2025论文影响力榜第11名,发布20个月内被引用400次以上。

我分析了重建与生成之间的优化矛盾,并提出表征对齐方法。在保持高质量重建的同时,该方法显著改善了下游生成效果和训练效率。VA-VAE对业界最顶级的模型产生了巨大影响。具不完全统计,这一方案被应用在阿里巴巴旗舰文生图模型 Qwen-Image-2,MiniMax 旗舰视频生成模型H3,海外顶级文生图模型FLUX.2中。 随 VA-VAE 一起,我向开源社区贡献了 LightningDiT。DiT是当前视觉生成模型的最核心架构。我开源的 LightningDiT 被 DiT 的发明人,纽约大学教授 谢赛宁 公开评价其为 “被验证的、鲁棒的升级版本,如果有可能,请尽量使用它”。 我的代表工作 ViTMatte 被 Information Fusion 接收。ViTMatte 是一种针对抠图任务的ViT模型。ViT的发明人,Lucas Beyer公开对ViTMatte表示称赞。该方法被 Huggingface Transformers集成为标准抠图方法。其中,我完全独立设计、训练、发布的模型 vitmatte-small 自发布以来已经累积被下载了6400 万次以上。 我深度参与了MiniMax H3模型的研发工作。MiniMax H3是当前最强的开源视频生成模型,性能与 Seedance 2.0 相当。大家平时刷到的 AI 短视频就有相当一部分是由MiniMax H3生成的。我

自2024年以来,在 MiniMax 连续发表 FasterDiT, LightningDiT, VA-VAE, VTP等工作,将学术研究和产业实践充分结合。同时输出顶级学术论文和行业最前沿的解决方案。目前,我已经有10项第一作者的专利,其中2项已经授权。 科研之外,我重视将个人成长与社会责任结合。我曾获得中国大学生“互联网+”创新创业大赛全国金奖,并代表学校赴云南临沧支教一年,在临翔区第一中学承担历史教学工作。这段经历让我更加理解责任、协作和长期投入的意义。 未来,我将继续研究生成模型与视觉表征,推动研究成果在真实场景中应用。


湖北省武汉市洪山区珞喻路1037号东十七楼  电话:027-87792776  领导邮箱:husteic@hust.edu.cn

华中科技大学 电子信息与通信学院