研究领域
视频理解 图像生成
导师介绍
【资历/研究方向】
C9华五高校毕业,主要研究CV与多模态大模型,多模态生成方向
【工作经历/实习经历】
秋招获得offer 8+,获得阿里、腾讯、快手、百度等大厂头部计划。曾在阿里实习,负责多模态大模型构建与训练,论文科研等。
学术荣誉/奖项:Google Scholar引用量累计近300。Github star数累计2k+。huggingface模型与数据下载量累计20w+。
【科研论文/审稿人】
在CCF-A类会议发表论文近10篇(一作3篇),包括NeurIPS、IJCAI、CVPR、ACM MM等。另外有两篇一作TPAMI在投。并担任CVPR,ICCV,ICML,NeurIPS等会议审稿人,TMM等期刊审稿人。
【可指导区位】
CCFA/B/C以及TMM期刊
【会议时间】
北京时间19:00-21:00
指导经验
指导师弟在CCF-A类会议CVPR,IJCAI等会议投稿,中稿三篇
招生方向
视觉理解,多模态图像生成,多模态预训练,多模态大模型,OCR
