Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $YECBGYFECGEAFWHA as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2

Deprecated: imwpcache\f884414bce24ee67f\f73723ec7b1919fa5::__construct(): Implicitly marking parameter $BBWFDDBHHYHDXXAB as nullable is deprecated, the explicit nullable type must be used instead in /www/wwwroot/www.chuangxiangniao.com/wp-content/plugins/imwpcache-dist/build/f884414bce24ee67ff73723ec7b1919fa5.php on line 2
多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL_创想鸟

多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL

面向视觉任务(如图像分类)的深度学习模型,通常用来自单一视觉域(如自然图像或计算机生成的图像)的数据进行端到端的训练。

 一般情况下,一个为多个领域完成视觉任务的应用程序需要为每个单独的领域建立多个模型,分别独立训练,不同领域之间不共享数据,在推理时,每个模型将处理特定领域的输入数据。 

即使是面向不同领域,这些模型之间的早期层的有些特征都是相似的,所以,对这些模型进行联合训练的效率更高。这能减少延迟和功耗,降低存储每个模型参数的内存成本,这种方法被称为多领域学习(MDL)。

此外,MDL模型也可以优于单领域模型,在一个域上的额外训练,可以提高模型在另一个域上的性能,这称为「正向知识迁移」,但也可能产生负向知识转移,这取决于训练方法和具体的领域组合。 虽然以前关于MDL的工作已经证明了跨领域联合学习任务的有效性,但它涉及到一个手工制作的模型架构,应用于其他工作的效率很低。 

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜

多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL 

论文链接:https://arxiv.org/pdf/2010.04904.pdf 

为了解决这个问题,在「Multi-path Neural Networks for On-device Multi-domain Visual Classification」一文中,谷歌研究人员提出了一个通用MDL模型。 

文章表示,该模型既可以有效地实现高精确度,减少负向知识迁移的同时,学习增强正向的知识迁移,在处理各种特定领域的困难时,可以有效地优化联合模型。 

多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL 

为此,研究人员提出了一种多路径神经架构搜索(MPNAS)方法,为多领域建立一个具有异质网络架构的统一模型。 

该方法将高效的神经结构搜索(NAS)方法从单路径搜索扩展到多路径搜索,为每个领域联合寻找一条最优路径。同时引入一个新的损失函数,称为自适应平衡域优先化(ABDP),它适应特定领域的困难,以帮助有效地训练模型。由此产生的MPNAS方法是高效和可扩展的。 

新模型在保持性能不下降的同时,与单领域方法相比,模型大小和FLOPS分别减少了78%和32%。 

多路径神经结构搜索

为了促进正向知识迁移,避免负向迁移,传统的解决方案是,建立一个MDL模型,使各域共享大部分的层,学习各域的共享特征(称为特征提取),然后在上面建一些特定域的层。 然而,这种特征提取方法无法处理具有明显不同特征的域(如自然图像中的物体和艺术绘画)。另一方面,为每个MDL模型建立统一的异质结构是很耗时的,而且需要特定领域的知识。

多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL

多路径神经搜索架构框架 NAS是一个自动设计深度学习架构的强大范式。它定义了一个搜索空间,由可能成为最终模型一部分的各种潜在构建块组成。 

搜索算法从搜索空间中找到最佳的候选架构,以优化模型目标,例如分类精度。最近的NAS方法(如TuNAS)通过使用端到端的路径采样,提高了搜索效率。 

受TuNAS的启发,MPNAS在两个阶段建立了MDL模型架构:搜索和训练。 

在搜索阶段,为了给每个领域共同找到一条最佳路径,MPNAS为每个领域创建了一个单独的强化学习(RL)控制器,它从超级网络(即由搜索空间定义的候选节点之间所有可能的子网络的超集)中采样端到端的路径(从输入层到输出层)。 

在多次迭代中,所有RL控制器更新路径,以优化所有领域的RL奖励。在搜索阶段结束时,我们为每个领域获得一个子网络。 最后,所有的子网络被结合起来,为MDL模型建立一个异质结构,如下图所示。

奇域 奇域

奇域是一个专注于中式美学的国风AI绘画创作平台

奇域 30 查看详情 奇域

 多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL 

由于每个域的子网络是独立搜索的,所以每一层的构件可以被多个域共享(即深灰色节点),被单个域使用(即浅灰色节点),或者不被任何子网络使用(即点状节点)。 

每个域的路径在搜索过程中也可以跳过任何一层。鉴于子网络可以以优化性能的方式自由选择沿路使用的区块,输出网络既是异质的又是高效的。 

下图展示了Visual Domain Decathlon的其中两个领域的搜索架构。

 多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL 

Visual Domain Decathlon是CVPR 2017中的PASCAL in Detail Workshop Challenge的一部分,测试了视觉识别算法处理(或利用)许多不同视觉领域的能力。 可以看出,这两个高度相关的域(一个红色,另一个绿色)的子网,从它们的重叠路径中共享了大部分构建块,但它们之间仍然存在差异。 

多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL

图中红色和绿色路径分别代表 ImageNet 和Describable Textures的子网络,深粉色节点代表多个域共享的块,浅粉色节点代表每条路径使用的块。图中的“dwb”块代表 dwbottleneck 块。图中的Zero块表示子网跳过该块 下图展示了上文提到的两个领域的路径相似性。 相似度通过每个域的子网之间的Jaccard相似度得分来衡量,其中越高意味着路径越相似。

 多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL

图为十个域的路径之间的Jaccard相似度得分的混淆矩阵。分值范围为0到1,分值越大表示两条路径共享的节点越多。 

训练异构多域模型

在第二阶段,MPNAS 产生的模型将针对所有领域从头开始训练。 为此,有必要为所有领域定义一个统一的目标函数。 为了成功处理各种各样的领域,研究人员设计了一种算法,该算法在整个学习过程中进行调整,以便在各个领域之间平衡损失,称为自适应平衡领域优先级 (ABDP)。 下面展示了在不同设置下训练的模型的准确率、模型大小和FLOPS。我们将MPNAS与其他三种方法进行比较: 

独立于域的 NAS:分别为每个域搜索和训练模型。

单路径多头:使用预训练模型作为所有域的共享主干,每个域都有单独的分类头。

多头 NAS:为所有域搜索统一的骨干架构,每个域都有单独的分类头。

 从结果中,我们可以观察到NAS需要为每个域构建一组模型,从而导致模型很大。 尽管单路径多头和多头NAS可以显着降低模型大小和FLOPS,但强制域共享相同的主干会引入负面的知识转移,从而降低整体准确性。

 多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL 

相比之下,MPNAS可以构建小而高效的模型,同时仍保持较高的整体精度。 MPNAS的平均准确率甚至比领域独立的NAS方法高1.9%,因为该模型能够实现积极的知识转移。 下图比较了这些方法的每个域top-1准确度。

 多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL 

评估表明,通过使用 ABDP 作为搜索和训练阶段的一部分,top-1 的准确率从 69.96% 提高到 71.78%(增量:+1.81%)。 

‍未来方向

MPNAS是构建异构网络以解决MDL中可能的参数共享策略的数据不平衡、域多样性、负迁移、域可扩展性和大搜索空间的有效解决方案。 通过使用类似MobileNet的搜索空间,生成的模型也对移动设备友好。 对于与现有搜索算法不兼容的任务,研究人员正继续扩展MPNAS用于多任务学习,并希望用MPNAS来构建统一的多域模型。

以上就是多路径多领域通吃!谷歌AI发布多领域学习通用模型MDL的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/540172.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
如何防止日志文件过大
上一篇 2025年11月9日 14:48:05
Kotlin中嵌套类与内部类:理解其实例化与作用
下一篇 2025年11月9日 14:48:18

相关推荐

  • 灵绘AI如何处理高清图像_灵绘AI高清图像生成与优化方法

    1、启用高清生成模式并设分辨率倍率为2x;2、用细节增强滤镜调节锐化至60%-80%并局部涂抹;3、先语义放大1.5倍再精细重建;4、导入HDR参考图设权重0.7-0.9并保留光照,可显著提升灵绘AI图像清晰度与质感。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepS…

    2026年9月12日
    000
  • 拼多多农产品客服遇到图片咨询怎么办?晓多图片识别系统对非标品咨询的处理优化!拼多多农产品客服遇图就慌?晓多AI图像识别系统让非标品咨询秒变“标准答案”

    在拼多多经营农产品的商家日常中,客服常常面临棘手问题:顾客发来一张光线昏暗的土鸡蛋照片询问保质期,或拍下破损的快递箱要求退换货。这类涉及非标品的图像咨询,往往成为客服响应效率的“绊脚石”。晓多科技推出的ai图片识别系统,正在用智能技术重塑这一传统服务模式。 一、农产品电商客服的图像咨询难题 1.1 …

    2026年9月12日
    100
  • OPPO Find X9影像实测:强得不像标准版

    OPPO Find X9影像实测:强得不像标准版OPPO Find X9影像实测:强得不像标准版OPPO Find X9影像实测:强得不像标准版OPPO Find X9影像实测:强得不像标准版

    在智能手机影像发展进入成熟阶段后,厂商们的竞争焦点已经从单纯比拼像素与硬件,转向更全面的“影像体验”。用户希望手机拍出的照片既要清晰,又要自然,既要保留细节,又要拥有真实的光影层次。 作为OPPO在2025年推出的旗舰机型,Find X9承载了品牌在移动影像领域多年积累的成果,也尝试通过软硬件结合的…

    2026年9月12日 用户投稿
    000
  • iPhone 18系列首发!苹果A20/A20 Pro已在路上

    10月24日消息,据媒体报道,苹果即将推出的a20系列芯片将分为两个版本:标准版代号为borneo,而高性能的a20 pro代号为borneo ultra。该系列芯片将采用台积电2nm工艺制程,成为苹果首款基于2纳米技术打造的手机处理器。 此前,苹果已在A系列芯片中实施差异化策略——标准版iPhon…

    2026年9月12日
    100
  • Coral NPU— 谷歌推出的全栈开源AI平台

    Coral NPU是什么 coral npu 是由谷歌推出的一个全栈开源人工智能平台,专为低功耗的边缘计算设备(例如智能手表、ar眼镜等)打造,旨在应对性能瓶颈、生态碎片化以及用户隐私保护三大核心挑战。该npu基于开放的 risc-v 指令集架构,集成了标量核心、向量执行单元和矩阵运算单元,能够高效…

    2026年9月12日
    300
  • 首款2nm手机芯片 苹果A20/A20 Pro明年到来,iPhone18 Pro先搭载

    据海外科技媒体报道,苹果即将推出的A20系列芯片将包含两个型号:标准版A20(开发代号Borneo)与高端版A20 Pro(代号Borneo Ultra)。这两款芯片均基于台积电先进的2纳米制程打造,成为苹果首款采用2nm工艺的移动处理器,标志着其在芯片技术上迈入全新阶段。延续以往产品布局,标准版芯…

    2026年9月11日
    000
  • 虚拟伴侣AI如何实现艺术创作 虚拟伴侣AI创意生成功能的开发方法

    虚拟伴侣AI如何实现艺术创作 虚拟伴侣AI创意生成功能的开发方法虚拟伴侣AI如何实现艺术创作 虚拟伴侣AI创意生成功能的开发方法虚拟伴侣AI如何实现艺术创作 虚拟伴侣AI创意生成功能的开发方法虚拟伴侣AI如何实现艺术创作 虚拟伴侣AI创意生成功能的开发方法

    虚拟伴侣AI可通过多模态模型、风格迁移、强化学习与情感计算实现艺术创作。首先构建跨模态神经网络,利用CLIP与Transformer架构,结合图文、音频数据预训练,实现文本生成图像或音乐;其次引入风格迁移技术,采用CNN提取艺术家风格特征,通过Gram矩阵优化生成结果,支持用户选择特定风格输出;再设…

    2026年9月11日 用户投稿
    100
  • 虚拟伴侣AI如何设置成长系统 虚拟伴侣AI自我进化机制的开发教程

    虚拟伴侣AI如何设置成长系统 虚拟伴侣AI自我进化机制的开发教程虚拟伴侣AI如何设置成长系统 虚拟伴侣AI自我进化机制的开发教程虚拟伴侣AI如何设置成长系统 虚拟伴侣AI自我进化机制的开发教程虚拟伴侣AI如何设置成长系统 虚拟伴侣AI自我进化机制的开发教程

    虚拟伴侣AI可通过动态自我进化机制实现个性化成长。首先定义情感表达、知识储备等成长维度,设定可量化指标与阶段性目标,并建立用户反馈映射模型;其次构建包含会话日志、偏好档案与本地加密缓存的动态学习数据库;接着部署支持移动端增量训练的轻量化神经网络,结合差分隐私与周期性微调实现在线学习;再通过强化学习式…

    2026年9月10日 用户投稿
    100
  • iPhone 18系列首发!A20系列芯片分批发布

    今日,据媒体报道,苹果a20系列芯片将推出标准版(代号borneo)与pro版(代号borneo ultra)两款型号,均基于台积电2nm工艺制程打造,成为苹果历史上首款采用2纳米技术的移动处理器。 延续过往产品策略,苹果继续实行芯片分级制度:标准机型配备基础版芯片,而高端Pro机型则搭载性能更强的…

    2026年9月10日
    000
  • 荣耀 X70 售价 1399 元起,携防弹衣架构 + 满级防水上市

    荣耀 X70 售价 1399 元起,携防弹衣架构 + 满级防水上市荣耀 X70 售价 1399 元起,携防弹衣架构 + 满级防水上市荣耀 X70 售价 1399 元起,携防弹衣架构 + 满级防水上市荣耀 X70 售价 1399 元起,携防弹衣架构 + 满级防水上市

    7 月 15 日晚 19 点,荣耀正式召开新品发布会,推出了 x 系列的最新成员——荣耀 x70,首发搭载“防弹衣架构”,起售价 1399 元,国补价低至 1189.15 元起。 作为荣耀 X 系列的最新旗舰,这款被官方称为“硬核之王”的手机,主打“抗摔、防水、续航”三大耐用性能的全面升级,借助旗舰…

    2026年9月10日 用户投稿
    100
  • 老照片修复AI效果怎么样 老照片修复AI软件下载

    老照片修复AI效果出色,支持色彩还原、缺损补全、分辨率提升、黑白上色及多人脸优化,采用深度神经网络与专用人脸重建模型,兼容多种格式,操作简便,可在线批量处理。 ☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 免费无限量使用 DeepSeek R1 模型☜☜☜ 老照片修复AI效果怎么样?这是不少…

    2026年9月10日
    000
  • AlphaGo 作者领衔,8 个机械臂协同干活 0 碰撞,DeepMind 新作登 Science 子刊

    AlphaGo 作者领衔,8 个机械臂协同干活 0 碰撞,DeepMind 新作登 Science 子刊AlphaGo 作者领衔,8 个机械臂协同干活 0 碰撞,DeepMind 新作登 Science 子刊AlphaGo 作者领衔,8 个机械臂协同干活 0 碰撞,DeepMind 新作登 Science 子刊AlphaGo 作者领衔,8 个机械臂协同干活 0 碰撞,DeepMind 新作登 Science 子刊

    一群机械臂手忙脚乱地自己干活,彼此配合、互不碰撞。 科幻大片场景真的走入现实了。优雅,实在是优雅。 △视频中为 4 个机械臂,在仿真环境下 4 个安装在桌子上,另外 4 个安装在天花板上。 这就是发表在 Science 子刊Science Robotics上,由 DeepMind、Intrinsic…

    2026年9月9日 用户投稿
    100
  • 苹果首款2nm芯片!A20/A20 Pro已在路上:iPhone 18系列首发

    据透露,苹果即将推出的a20系列芯片将分为两个型号:基础版a20(内部代号为borneo)以及更高阶的a20 pro(代号borneo ultra)。这两款芯片均基于台积电最新的2nm制程技术打造,标志着苹果首次在智能手机芯片中采用2nm工艺。 回顾过往,苹果在A系列芯片的布局上一贯实行区分策略——…

    2026年9月8日
    200
  • MySQL高级知识之 架构介绍

    MySQL高级知识之 架构介绍MySQL高级知识之 架构介绍MySQL高级知识之 架构介绍MySQL高级知识之 架构介绍

    mysql视频教程栏目介绍mysql高级知识的架构 推荐(免费):mysql视频教程 1、MySQL 简介 概述 MySQL是一个关系型数据库管理系统,由瑞典MySQL AB公司开发,目前属于Oracle公司。 MySQL是一种关联数据库管理系统,将数据保存在不同的表中,而不是将所有数据放在一个大仓…

    2026年9月6日 用户投稿
    300
  • AI做音乐推荐怎么实现_Spotify推荐算法原理与应用

    AI做音乐推荐怎么实现_Spotify推荐算法原理与应用AI做音乐推荐怎么实现_Spotify推荐算法原理与应用AI做音乐推荐怎么实现_Spotify推荐算法原理与应用AI做音乐推荐怎么实现_Spotify推荐算法原理与应用

    答案:AI音乐推荐通过协同过滤、内容分析、混合系统和上下文感知等多维度算法,结合用户行为与歌曲特征,实现个性化推荐。Spotify利用隐式反馈、音频特征提取、深度学习和NLP技术,融合用户偏好与情境因素,解决冷启动问题,并在探索与利用间平衡,持续优化用户体验。 ☞☞☞AI 智能聊天, 问答助手, A…

    2026年9月4日 用户投稿
    000
  • 智能助手怎么处理多模态任务_AI理解图片语音和文本方法

    多模态智能助手通过多模态嵌入、注意力机制、Transformer架构和对比学习等技术,将图像、语音和文本统一表示并关联,实现跨模态理解与响应;实际应用中面临数据稀疏性、模态不对齐、异构性和计算复杂度等挑战;性能评估需结合单模态指标、跨模态指标、用户满意度及对抗性测试综合判断。 ☞☞☞AI 智能聊天,…

    2026年8月29日
    000
  • 你管这玩意叫双系统?直接在 Windows 上体验 Linux

    你管这玩意叫双系统?直接在 Windows 上体验 Linux你管这玩意叫双系统?直接在 Windows 上体验 Linux你管这玩意叫双系统?直接在 Windows 上体验 Linux你管这玩意叫双系统?直接在 Windows 上体验 Linux

    现在可以在windows上体验linux的gui了,酷不酷?这绝对是酷毙了! 原来是Windows官方推出的Linux子系统(WSL)终于支持了Linux GUI!这意味着你可以直接在Windows系统中运行你喜欢的GUI编辑器和工具,来开发和测试Linux应用程序。曾经多少Linux爱好者的梦想—…

    2026年8月26日 用户投稿
    200
  • HTMLPagelinks怎么优化_分页链接SEO优化技巧

    答案是:分页SEO的核心在于通过“查看全部”页面集中权重或构建清晰的内部链接结构来引导搜索引擎理解页面关系。应优先创建“查看全部”页面整合内容,并设置canonical标签指向该页,同时确保分页导航为可抓取的HTML链接,包含前后页、首尾页及附近页码链接,以提升抓取效率、传递权重并改善用户体验,从而…

    2025年12月22日
    000
  • javascript的机器学习如何入门_有哪些可用的JavaScript库

    JavaScript适合浏览器端轻量推理与教学,不宜训练大模型;推荐从线性回归、KNN等简单任务入手,优先掌握张量操作、模型流程及Chrome调试技巧。 JavaScript 做机器学习确实可行,但得明确一点:它不适合训练大型模型,更适合在浏览器端做轻量推理、数据预处理、教学演示或与 Web 应用集…

    2025年12月21日
    100
  • JavaScript数学计算与数值分析库

    math.js适合日常复杂计算,numeric.js专精数值分析,simple-statistics用于统计分析,TensorFlow.js适用于AI与大规模数值运算。 JavaScript虽然原生支持基本的数学运算,但在处理复杂数学计算、数值分析或科学计算时,依赖第三方库能大幅提升开发效率和计算精…

    2025年12月21日
    000

发表回复

登录后才能评论
关注微信