研究领域
大语言模型联邦微调 大语言模型推理加速 大语言模型幻觉控制 大预言模型检索增强生成
导师介绍
【资历/研究方向】南京大学计算机系博士,主要研究联邦学习场景及大语言模型应用。曾在阿里巴巴通义实验室实习。
【科研论文/审稿人】
在国际会议和期刊上发表论文8篇(其中一作3篇),包括ACL、WWW、VLDB等;
长期担任NeurIPS、ACL、AAAI等会议期刊审稿人。
【指导特点】
擅长帮助同学把握目标研究方向的发展脉络和潜在突破点,擅长研究创新场景和创新应用。
招生方向
1.大语言模型现实场景研究:大语言模型的联邦微调;大语言模型的推理加速;大语言模型的幻觉控制。
2.大语言模型检索增强生成应用研究:图引导的检索增强生成;参数化的检索增强生成。
