一、什么是MoE?
MoE(Mixture of Experts)是一类通过多个「专家」子网络配合路由器(Router)动态分配算力的稀疏大模型架构,让模型在不显著增加推理计算量的前提下大幅扩展总参数量,已成为主流大模型扩展的关键技术路线之一,支撑万亿参数模型。
二、MoE包含哪些模块?
· 视觉编码器
· 跨模态对齐
· 联合嵌入空间
三、MoE的发展历程
2019 年 ViLBERT、VisualBERT 开启视觉-语言预训练,2021 年 CLIP 实现图文对齐里程碑,2023 年 GPT-4V、Gemini 等原生多模态大模型发布,2024 年视频理解、实时语音多模态成为新前沿。
四、MoE的核心价值有哪些?
· 打破模态壁垒
· 支撑更自然人机交互