教育经历

2021-2026年 中国人民大学 博士

2017-2021年 电子科技大学 本科

教授课程

本科生课程:《程序设计》

研究方向

外部感知与认知。 提升多模态智能对于外部环境的感知与认知能力,使其能够在复杂的物理与数字环境中实现连贯的理解、推理与交互。

内在学习机制。 从理论视角探究统一学习范式下异质多模态信息协同、整合与交互的内在机制。

研究成果

卫雅珂.png


联系

邮箱:yakewei@ruc.edu.cn

个人网页:https://echo0409.github.io/

学术论文

更多介绍见主页https://echo0409.github.io/

2026

Information-Theoretic Decomposition for Multimodal Interaction Learning

Zequn Yang, Yake Wei, Haotian Ni, Zhihao Xu, Di Hu

CVPR, 2026

2025

MokA: Multimodal Low-Rank Adaptation for MLLMs

Yake Wei, Yu Miao, Dongzhan Zhou, Di Hu

NeurIPS (Oral Presentation), 2025

RollingQ: Reviving the Cooperation Dynamics in Multimodal Transformer

Haotian Ni, Yake Wei, Hang Liu, Gong Chen, Chong Peng, Hao Lin, Di Hu

ICML, 2025

Adaptive Unimodal Regulation for Balanced Multimodal Information Acquisition

Chengxiang Huang*, Yake Wei*, Zequn Yang, Di Hu

CVPR, 2025

Patch Matters: Training-free Fine-grained Image Caption Enhancement via Local Perception

Ruotian Peng, Haiying He, Yake Wei, Yandong Wen, Di Hu

CVPR, 2025

2024

On-the-fly Modulation for Balanced Multimodal Learning

Yake Wei, Di Hu, Henghui Du, Ji-Rong Wen

T-PAMI, 2024

Diagnosing and Re-learning for Balanced Multimodal Learning

Yake Wei, Siwei Li, Ruoxuan Feng, Di Hu

ECCV, 2024

MMPareto: Boosting Multimodal Learning with Innocent Unimodal Assistance

Yake Wei, Di Hu

ICML, 2024

Enhancing Multimodal Cooperation via Sample-level Modality Valuation

Yake Wei, Ruoxuan Feng, Zihe Wang, Di Hu

CVPR, 2024

Quantifying and Enhancing Multi-modal Robustness with Modality Preference

Zequn Yang, Yake Wei, Ce Liang, Di Hu

ICLR, 2024

2023

Geometric-inspired graph-based Incomplete Multi-view Clustering

Zequn Yang, Han Zhang, Yake Wei, Zheng Wang, Feiping Nie, Di Hu

Pattern Recognition, 2023

2022

Balanced Multimodal Learning via On-the-fly Gradient Modulation

Xiaokang Peng*, Yake Wei*, Andong Deng, Dong Wang, Di Hu

CVPR (Oral Presentation), 2022

Learning to Answer Questions in Dynamic Audio-Visual Scenarios

Guangyao Li*, Yake Wei*, Yapeng Tian*, Chenliang Xu, Ji-Rong Wen, Di Hu

CVPR (Oral Presentation), 2022

Class-aware Sounding Objects Localization via Audiovisual Correspondence

Di Hu, Yake Wei, Rui Qian, Weiyao Lin, Ruihua Song, Ji-Rong Wen

T-PAMI, 2021