当前位置:首页 > 探索 > 智子引擎开源多模态MoE大模型,可高效扩展模型容量

智子引擎开源多模态MoE大模型,可高效扩展模型容量

转载整理自 智子引擎
量子位 | 公众号 QbitAI

随着多模态大模型的智引展模快速发展,当前主流多模态大模型具备完成多种任务的擎开能力(图文描述、视觉问答、源多南平市某某广告媒体售后客服中心文字识别、模态模型图标理解、可高目标检测等)。效扩型容但是智引展模,这些不同的擎开多模态任务往往具有完全不同的数据分布,导致在模型训练过程中遇到“多任务冲突”的源多问题,尤其在模型参数量较小时,模态模型这种问题尤为突出。可高如何才能在有限增加模型参数量以及训练成本的效扩型容条件下,高效地扩展模型容量,智引展模南平市某某广告媒体售后客服中心缓解多模态大模型“多任务冲突”问题?

近日,擎开针对这一挑战,源多来自大模型初创公司智子引擎的研究团队开源了基于MoE架构的多模态大模型Awaker2.5-VL。Awaker2.5-VL通过设置多个专家,扩展了模型在不同任务上的能力,有效地缓解了多模态“多任务冲突”的问题。该模型还对MoE中门控网络的路由策略进行了细致的研究,并设计了一个简单且十分有效的路由策略,提升了模型训练的稳定性。目前,Awaker2.5-VL的论文和代码已经公开,后续还会更新更强的版本。



论文地址:
https://arxiv.org/abs/2411.10669

代码仓库:
https://github.com/MetabrainAGI/Awaker



模型架构

Awaker2.5-VL采用参数高效的LoRA-MoE架构,如下图(左)所示。该架构包含多个Task Expert和一个Global Expert,分别学习专用知识和通用知识,每个专家都是一个LoRA结构。此外,该架构还包含一个门控网络用于控制专家的激活。这种MoE架构可以在Attention、MLP等结构中执行快速插入的操作,并且还可以通过调整每个LoRA的秩自行调整模型的参数量。Awaker2.5-VL还设计了一个简化版的MoE架构,如下图(右)所示,在这个简化版MoE中,门控网络被移除,而是由其它层MoE共享的路由结果控制专家的激活。Awaker2.5-VL在基座模型中的不同模块穿插使用这两种MoE架构。



Awaker2.5-VL采用的两种MoE架构

Awaker2.5-VL针对MoE架构中门控网络的路由策略进行了研究,并设计了一种简单且有效的Instance-level的路由策略。该策略将图片和问题的Embedding作为门控网络的输入,并且为了保持训练和推理时路由的一致性,训练时数据中的label部分不参与路由。此外,与传统MoE不同的是,Awaker2.5-VL每一层MoE的门控网络都共享相同的输入。这种简单高效的路由策略降低了模型的复杂度,提高了模型的稳定性。

模型训练

Awaker2.5-VL以Qwen2-VL-7B-Instruct作为基座模型进行实现,总模型参数量为10.8B。训练分为三个阶段,如下图所示。第一阶段,初始化训练。在该阶段基座模型被冻结,并设置一个单LoRA进行训练。第二阶段,MoE训练。该阶段进行整个MoE模块的训练(包括每个专家和门控网络),其中每个专家都使用第一阶段训练的LoRA进行参数初始化。第三阶段,指令微调阶段。该阶段将MoE的门控网络冻结,仅训练每个“专家”,将进一步加强模型的指令跟随能力。同时,该阶段的训练策略也适用于基座模型在其他下游任务微调的场景。



Awaker2.5-VL的三阶段训练过程

Awaker2.5-VL一共使用了1200万的指令数据进行模型训练,其中包括700万的英文数据和500万的中文数据。英文数据主要来源于开源数据,包括Cambrian (2M)、LLaVAOneVision (4M)、Infinity-MM (800K)、MathV360k (360K)等。中文数据则是智子引擎团队的自建数据集,包括图文描述、图文问答、目标检测、文字识别等多种任务数据。

模型性能

Awaker2.5-VL主要在MME-Realworld系列和MMBench系列Benchmark上分别进行了中文测评和英文测评。MME-Realworld是当前最难、规模最大多模态评测基准,而MMBench是主流多模态大模型参评最多的评测基准之一。

Awaker2.5-VL在MME-Realworld和MME-Realworld-CN都位列榜首,且是目前唯一在该Benchmark上“及格”(超过60分)的模型。考虑到MME-Realworld主要面向自动驾驶、遥感、视频监控等复杂场景,Awaker2.5-VL在MME-Realworld上的出色表现很好地展示它在落地应用中的巨大潜力。





Awaker2.5-VL分别在MMBench、MMBench_v1.1、MMBench_CN、MMBench_CN_v1.1四个榜单进行了测评,并且分别以英文能力平均分数(MMBench和MMBench_v1.1)和中文能力平均分数(MMBench_CN和MMBench_CN_v1.1)进行排序。Awaker2.5-VL在中文场景和英文场景中分别位列第9和第7。在同量级参数量的模型中,Awaker2.5-VL表现远超其他模型。这就是说Awaker2.5-VL能够兼顾模型效果和资源消耗,也进一步证明它具有极大的落地应用价值。





模型应用

2024年,智子引擎已经成功地将Awaker2.5-VL应用于多个复杂的实际场景,包括国家电网、社会治理、服务型机器人等。在即将到来的2025年,智子引擎将继续探索Awaker2.5-VL更多的落地应用场景。为了鼓励这种探索,智子引擎选择开源Awaker2.5-VL,基于战略合作伙伴清昴智能的华为昇腾原生工具链MLGuider-Ascend,Awaker2.5-VL已适配昇腾全产品线,希望更多生态伙伴能够参与进来。同时,为了加速国产化AI进程,Awaker系列开源模型与清昴智能已形成标准的昇腾国产方案,将上线至昇腾平台,欢迎大家关注和使用。

(责任编辑:休闲)

推荐文章
  • 泽连斯基:乌克兰已放弃加入北约

    泽连斯基:乌克兰已放弃加入北约   来源:财联社  财联社12月14日电,据环球时报,乌克兰总统泽连斯基在柏林会晤美国特使前夕表示,乌克兰已放弃加入北约的目标,以此换取西方的安全保障,作为结束俄乌冲突的妥协方案。这一举措标志着乌克兰 ...[详细]
  • 卡萨多助攻莱万破门,巴萨拔头筹!

    卡萨多助攻莱万破门,巴萨拔头筹!   来源:直播吧  直播吧10月27日讯西甲第11轮,第54分钟,卡萨多助攻,莱万破门,巴萨1-0领先皇马!点击进入专题: 2024-25赛季西甲联赛 ...[详细]
  • 部分饮料中或有金属碎片!可口可乐在欧洲召回2800万瓶产品

    部分饮料中或有金属碎片!可口可乐在欧洲召回2800万瓶产品 据报道,由于担心奥地利工厂生产过程中出现技术缺陷,可能导致部分饮料产品中含有金属碎片,可口可乐公司近日决定自愿召回部分产品。当地时间10月24日,维也纳市场管理局发言人亚历山大·亨格尔表示,这是该国至 ...[详细]
  • 计划出国留学?明天这场信息说明会不容错过!

    计划出国留学?明天这场信息说明会不容错过! 想申请国家公派留学,需要满足什么条件呢?可以申请哪些学校?有奖学金吗?留学面试有哪些注意事项?签证怎么办理?10月26日,国际研究生奖学金信息说明会2024年广州站活动将在华南理工大学五山校区开展,为 ...[详细]
  • 门头沟这个物业助力房产证办理工作!

    门头沟这个物业助力房产证办理工作! 在社区生活中,物业不仅是管理者、服务者,更是居民身边的贴心人。近期,龙泉镇中门寺南坡小区正在办理房产证,瑞龙祥物业团队以实际行动为居民提供便利,帮助大家顺利办证,在严严冬日温暖了居民的心。房产证办理涉 ...[详细]
  • 【地理素养】三角洲相的鉴别标志、高考地理综合思维方法例析!

    【地理素养】三角洲相的鉴别标志、高考地理综合思维方法例析! 1.岩石类型单一三角洲沉积以砂岩、粉砂岩、粘土岩为主,在三角洲平原中常见有暗色有机质沉积。无或极少砾岩及化学岩,这是与河流相和湖泊相区别之一。碎屑岩的成分成熟度和结构成熟度比河流相高。2.粒度分布特征 ...[详细]
  • 工行、农行陆续落地首批互换便利工具债券回购交易

    工行、农行陆续落地首批互换便利工具债券回购交易   10月23日,澎湃新闻从中国农业银行获悉,10月22日,农业银行与头部券商达成质押互换央行票据的债券回购,是全市场首批落地互换便利债券回购的三家银行之一。  证券、基金、保险公司互换便利SFISF ...[详细]
  • 俄罗斯将效仿西方国家使用不友好国家资产收益

    俄罗斯将效仿西方国家使用不友好国家资产收益 △俄罗斯财政部长西卢安诺夫  当地时间10月24日,俄罗斯财政部长西卢安诺夫表示,西方国家开始使用俄罗斯被冻结资产收益,俄罗斯也将采取同样的做法。俄方已作出相关决定。  西卢安诺夫称,俄罗斯拥有被冻结 ...[详细]
  • 6000架空客A320飞机紧急换软件,空客公司致歉

    6000架空客A320飞机紧急换软件,空客公司致歉 来源:环球时报【环球时报驻德国特约记者 昭东 环球时报记者 肖震冬】德国《时代周报》11月28日称,欧洲飞机制造商空客公司当天宣布:约6000架空客A320飞机的飞行控制系统存在安全隐患,必须接受检查 ...[详细]
  • 莱万破门,巴萨1

    莱万破门,巴萨1   来源:直播吧  直播吧10月27日讯西甲第11轮,第54分钟,莱万破门,巴萨1-0领先皇马! ...[详细]