大模型系列成果(全院教师参与)
成果介绍:中国人民大学高瓴人工智能学院自创立之初就前瞻性地布局大模型技术研究,于2020年9月开始着手研发"文澜"多模态大模型,成为全球最早开展大模型研究的学术机构之一。学院师生集中科研力量进行有组织的大模型技术攻关。在语言大模型领域,通过持续突破关键技术瓶颈,成功构建"玉兰"系列开源大语言模型,包括百亿级参数的YuLan、轻量化的YuLan-Mini及创新性的非自回归模型LLaDA,系统掌握了预训练全链条技术,成为国内少数具备从头预训练能力的高校团队。在多模态领域,基于文澜模型的技术积累,相继研发出视频生成大模型VDT和图文大模型Awaker,部分核心技术领先于OpenAI等顶尖大模型公司发布。依托中国人民大学的学科优势,学院重点推进"AI+"跨学科创新,形成了AI社会科学研究仿真模拟框架与涉外法治大模型等特色成果。学院团队沉淀了深厚的技术积累,发表了首篇大模型综述《A Survey of Large Language Model》及《大语言模型》教材,有力推动了大模型技术推广;学院培养的优秀人才多次获得国际顶级会议奖项,毕业生就职于通义千问、字节跳动等知名企业,成为我国大模型产业的中坚力量。
