一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

深度学习领域的一篇标志性论文,终于迎来了它的“封神”时刻!

在刚刚举行的 ICML 2025 大会上,2015 年发表的 Batch Normalization(批次归一化,简称 BatchNorm)论文荣获时间检验奖。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

这篇如今被引用超过 6 万次的开创性研究,是深度学习发展历程中的一个关键节点,极大地促进了深层神经网络的训练与广泛应用。

可以说,它是促使深度学习从实验室走向实际应用的重要技术之一。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

一个简单而强大的想法,让训练速度显著提升

2015 年时,深度学习界正面临一个棘手问题:如何稳定地训练深层神经网络?

研究人员发现,随着网络层数的增加,训练过程变得极其不稳定。必须小心控制学习率,否则梯度很容易消失或爆炸。

更糟糕的是,模型对参数初始化极为敏感,稍微改变初始化方式就可能导致完全无法训练。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

谷歌研究员 Sergey Ioffe 和 Christian Szegedy 抓住了问题的核心:在训练过程中,网络内部的数据分布不断变化。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

△左:Sergey Ioffe,右:Christian Szegedy

他们将这一现象命名为“内部协变量偏移”(Internal Covariate Shift),指的是在训练中,每一层的参数更新都会导致后续层输入数据分布的变化,迫使网络不断适应新的分布,从而带来训练困难。

他们的解决思路非常巧妙:既然标准化输入数据有助于模型训练,那么是否也可以对隐藏层做类似操作?

BatchNorm 的做法是对每个小批次数据计算均值和方差,并据此进行标准化处理,使数据服从均值为 0、方差为 1 的分布。

但其中还有一个巧妙设计——引入两个可学习参数 γ(缩放因子)和 β(平移因子),允许网络自主调整输出分布,从而保持模型表达能力不受限制。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

原论文的实验结果令人惊艳,在当时最先进的图像分类模型上,使用 BN 后仅需原来 1/14 的训练步数即可达到相同精度。

并在 ImageNet 分类任务中取得当时最佳成绩,超越了人类评估者的准确率。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

成为深度学习基石,却被质疑理论基础

BatchNorm 初版提交于 2015 年初,其影响力远超作者预期,不仅提升了训练效率,还带来了意想不到的好处。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

例如,它具有一定的正则化效果。由于每个小批次的统计量存在微小差异,这种噪声效应类似于 Dropout,有助于提升模型泛化能力,甚至在某些情况下可以替代 Dropout。

在 BatchNorm 出现之前,训练几十层以上的网络极为困难。

2015 年底,何恺明等人提出的 ResNet 结合残差连接与 BatchNorm,使得训练上百乃至上千层的超深网络成为可能。

此后几乎所有主流卷积神经网络(如 ResNet、DenseNet、Inception)及其他类型的模型都广泛采用了 BatchNorm。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

然而,戏剧性的转折出现在 2018 年。

MIT 的研究团队挑战了 BatchNorm 的核心理论。

他们在标准 BN 层后加入随机噪声,人为制造“内部协变量偏移”。按原理论,这应该会削弱 BN 的效果。

但实验结果显示,即使存在剧烈分布偏移,BN 模型的训练速度仍远胜于未使用 BN 的模型。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

该研究指出,BatchNorm 实际上改善了优化空间的平滑性,使梯度更加稳定可控,从而加快训练速度。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

到了 2022 年,又有研究从几何角度提供了新见解。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

这项研究表明,BN 其实是一种无监督学习机制,能够让网络在训练初期就主动适应数据结构,相当于一种“智能初始化”。

此外,由小批次统计量波动带来的噪声还能扩大分类边界,从而提升模型泛化性能。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

两位作者现状如何?

十年过去,这篇改变历史的论文的两位作者 Sergey Ioffe 和 Christian Szegedy 现在都在哪里?

两人曾在谷歌工作十余年,直到 2023 年 Christian Szegedy 加入马斯克团队,成为 xAI 联合创始人。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

2024 年初,Sergey Ioffe 也加入 xAI,参与 Grok 4 的开发工作。

不过后来 Christian Szegedy 离开 xAI,转投 AI 编程初创公司 Morph Labs 担任首席科学家。

这家公司目标宏大——致力于实现“可验证的超级智能”。这位深度学习先驱,正在为 AI 的下一个十年布局。

 一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖

BatchNorm 原始论文:

https://www.php.cn/link/4efa2dce0e842cbc488548530dd8bf01

参考链接:

[ 1 ] https://www.php.cn/link/35296a4054db6816185054cbdc02e041

[ 2 ] https://www.php.cn/link/fa1d8223da871d94d79d2f175e0f5f1d

一键三连「点赞」「转发」「小心心」

欢迎在评论区留下你的观点!

— 完 —

专属 AI 产品从业者的实名社群,只聊最落地的 AI 产品真问题。扫码添加小助手,发送「姓名 + 公司 + 职位」申请入群~

进群后你将获得:

最新最专业的 AI 产品信息及分析

不定期发放热门产品内测码

内部专属内容与专业讨论

点亮星标

科技前沿每日更新

以上就是一篇被证明“理论有误”的论文,拿下了 ICML2025 时间检验奖的详细内容,更多请关注创想鸟其它相关文章!

版权声明:本文内容由互联网用户自发贡献,该文观点仅代表作者本人。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。
如发现本站有涉嫌抄袭侵权/违法违规的内容, 请发送邮件至 chuangxiangniao@163.com 举报,一经查实,本站将立刻删除。
发布者:程序猿,转转请注明出处:https://www.chuangxiangniao.com/p/145247.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
上一篇 2025年12月2日 04:43:24
下一篇 2025年12月2日 05:15:58

相关推荐

  • 云闪付怎么快速赚取积点_云闪付积点快速获取方法

    通过微信小程序用云闪付支付可日赚692积点;62VIP会员消费满10元返积点,月上限3000;转账超1000元得2积点,还款超100元得10积点,每月各限3笔;扫本人收款码支付5元以上每笔得10积点,日限3笔;改定位至杭州领“浙里有优惠”活动卡可得2025积点。 如果您在使用云闪付时希望快速积累积点…

    2025年12月6日 软件教程
    400
  • 怎样用免费工具美化PPT_免费美化PPT的实用方法分享

    利用KIMI智能助手可免费将PPT美化为科技感风格,但需核对文字准确性;2. 天工AI擅长优化内容结构,提升逻辑性,适合高质量内容需求;3. SlidesAI支持语音输入与自动排版,操作便捷,利于紧急场景;4. Prezo提供多种模板,自动生成图文并茂幻灯片,适合学生与初创团队。 如果您有一份内容完…

    2025年12月6日 软件教程
    000
  • Pages怎么协作编辑同一文档 Pages多人实时协作的流程

    首先启用Pages共享功能,点击右上角共享按钮并选择“添加协作者”,设置为可编辑并生成链接;接着复制链接通过邮件或社交软件发送给成员,确保其使用Apple ID登录iCloud后即可加入编辑;也可直接在共享菜单中输入邮箱地址定向邀请,设定编辑权限后发送;最后在共享面板中管理协作者权限,查看实时在线状…

    2025年12月6日 软件教程
    100
  • REDMI K90系列正式发布,售价2599元起!

    10月23日,redmi k90系列正式亮相,推出redmi k90与redmi k90 pro max两款新机。其中,redmi k90搭载骁龙8至尊版处理器、7100mah大电池及100w有线快充等多项旗舰配置,起售价为2599元,官方称其为k系列迄今为止最完整的标准版本。 图源:REDMI红米…

    2025年12月6日 行业动态
    200
  • Linux中如何安装Nginx服务_Linux安装Nginx服务的完整指南

    首先更新系统软件包,然后通过对应包管理器安装Nginx,启动并启用服务,开放防火墙端口,最后验证欢迎页显示以确认安装成功。 在Linux系统中安装Nginx服务是搭建Web服务器的第一步。Nginx以高性能、低资源消耗和良好的并发处理能力著称,广泛用于静态内容服务、反向代理和负载均衡。以下是在主流L…

    2025年12月6日 运维
    000
  • Linux journalctl与systemctl status结合分析

    先看 systemctl status 确认服务状态,再用 journalctl 查看详细日志。例如 nginx 启动失败时,systemctl status 显示 Active: failed,journalctl -u nginx 发现端口 80 被占用,结合两者可快速定位问题根源。 在 Lin…

    2025年12月6日 运维
    100
  • 华为新机发布计划曝光:Pura 90系列或明年4月登场

    近日,有数码博主透露了华为2025年至2026年的新品规划,其中pura 90系列预计在2026年4月发布,有望成为华为新一代影像旗舰。根据路线图,华为将在2025年底至2026年陆续推出mate 80系列、折叠屏新机mate x7系列以及nova 15系列,而pura 90系列则将成为2026年上…

    2025年12月6日 行业动态
    100
  • 2025年双十一买手机选直板机还是选折叠屏?建议看完这篇再做决定

    随着2025年双十一购物节的临近,许多消费者在选购智能手机时都会面临一个共同的问题:是选择传统的直板手机,还是尝试更具科技感的折叠屏设备?其实,这个问题的答案早已在智能手机行业的演进中悄然浮现——如今的手机市场已不再局限于“拼参数、堆配置”的初级竞争,而是迈入了以形态革新驱动用户体验升级的新时代。而…

    2025年12月6日 行业动态
    000
  • Linux如何优化系统性能_Linux系统性能优化的实用方法

    优化Linux性能需先监控资源使用,通过top、vmstat等命令分析负载,再调整内核参数如TCP优化与内存交换,结合关闭无用服务、选用合适文件系统与I/O调度器,持续按需调优以提升系统效率。 Linux系统性能优化的核心在于合理配置资源、监控系统状态并及时调整瓶颈环节。通过一系列实用手段,可以显著…

    2025年12月6日 运维
    000
  • 猜一猜卡牌评级师评定的是什么产品

    支付宝蚂蚁新村最新答案2025年10月25日 1、猜一猜:“卡牌评级师”评定的是什么产品 2、正确答案:热门卡牌 3、答案解析: Type Studio 一个视频编辑器,提供自动转录、自动生成字幕、视频翻译等功能 61 查看详情 近年来,潮玩市场持续升温,卡牌逐渐成为潮流文化与热门IP结合的重要形式…

    2025年12月6日 软件教程
    000
  • 长城汽车公布最新财报:前三季度卖车92万辆 净赚86亿元

    10月24日,长城汽车今日下午公布了其2025年第三季度财务报告。 财报数据显示,今年前三季度,长城汽车实现营业收入1535.82亿元,同比增长7.96%;归属于上市公司股东的净利润为86.35亿元,同比下降16.97%。其中,第三季度单季营收达612.47亿元,同比增长20.51%;归母净利润为2…

    2025年12月6日 行业动态
    000
  • 曝小米17 Air正在筹备 超薄机身+2亿像素+eSIM技术?

    近日,手机行业再度掀起超薄机型热潮,三星与苹果已相继推出s25 edge与iphone air等轻薄旗舰,引发市场高度关注。在此趋势下,多家国产厂商被曝正积极布局相关技术,加速抢占这一细分赛道。据业内人士消息,小米的超薄旗舰机型小米17 air已进入筹备阶段。 小米17 Pro 爆料显示,小米正在评…

    2025年12月6日 行业动态
    000
  • 「世纪传奇刀片新篇」飞利浦影音双11声宴开启

    百年声学基因碰撞前沿科技,一场有关声音美学与设计美学的影音狂欢已悄然引爆2025“双十一”! 当绝大多数影音数码品牌还在价格战中挣扎时,飞利浦影音已然开启了一场跨越百年的“声”活革命。作为拥有深厚技术底蕴的音频巨头,飞利浦影音及配件此次“双十一”精准聚焦“传承经典”与“设计美学”两大核心,为热爱生活…

    2025年12月6日 行业动态
    000
  • 荣耀手表5Pro 10月23日正式开启首销国补优惠价1359.2元起售

    荣耀手表5pro自9月25日开启全渠道预售以来,市场热度持续攀升,上市初期便迎来抢购热潮,一度出现全线售罄、供不应求的局面。10月23日,荣耀手表5pro正式迎来首销,提供蓝牙版与esim版两种选择。其中,蓝牙版本的攀登者(橙色)、开拓者(黑色)和远航者(灰色)首销期间享受国补优惠价,到手价为135…

    2025年12月6日 行业动态
    000
  • 中国大陆电竞显示器线上销量出炉:小米第6 增速最快

    10月25日消息,今天,洛图科技发布的2025q3中国大陆电竞显示器线上市场最新报告。 报告显示,其中AOC以近20%的份额领跑,销量同比增长57%。HKC位居第二,销量同比增长53%。 KTC、SANC、泰坦军团也进入前五,但销量分别下滑了23%、13%和25%,主要原因是去年9月国补政策导致的高…

    2025年12月6日 行业动态
    000
  • 《黑神话:悟空》官方宣布全新艺术展要来了!馆内还有老熟人

    《黑神话:悟空》官方今日正式发布消息,《黑神话:悟空》遇见山西——古建数字艺术展将于2025年11月1日在太原美术馆·古县城美术新空间正式启动。据悉,此次展览将集中呈现山西大地上的古建筑精华,让观众沉浸式体验中华文明绵延千年的辉煌遗产。更有神秘“老朋友”可能现身展馆,亲自担任导览角色,带来惊喜互动。…

    2025年12月6日 游戏教程
    000
  • 环境搭建docker环境下如何快速部署mysql集群

    使用Docker Compose部署MySQL主从集群,通过配置文件设置server-id和binlog,编写docker-compose.yml定义主从服务并组网,启动后创建复制用户并配置主从连接,最后验证数据同步是否正常。 在Docker环境下快速部署MySQL集群,关键在于合理使用Docker…

    2025年12月6日 数据库
    000
  • RTX 5090性能怪兽!雷蛇灵刃18 2025游戏本图赏

    10月25日,雷蛇正式推出全新灵刃18 2025款旗舰级游戏笔记本,首发搭载nvidia rtx 50系列显卡,起售价为25999元。 目前该机型已抵达评测室,以下为实机图赏。 新款灵刃18配备一块18英寸双模屏幕,支持UHD+ 240Hz与FHD+ 440Hz两种显示模式,响应时间最快可达3ms。…

    2025年12月6日 行业动态
    000
  • Xbox删忍龙美女角色 斯宾塞致敬板垣伴信被喷太虚伪

    近日,海外游戏推主@HaileyEira公开发表言论,批评Xbox负责人菲尔·斯宾塞不配向已故的《死或生》与《忍者龙剑传》系列之父板垣伴信致敬。她指出,Xbox并未真正尊重这位传奇制作人的创作遗产,反而在宣传相关作品时对内容进行了审查和删减。 所涉游戏为年初推出的《忍者龙剑传2:黑之章》,该作采用虚…

    2025年12月6日 游戏教程
    000
  • 如何在mysql中分析索引未命中问题

    答案是通过EXPLAIN分析执行计划,检查索引使用情况,优化WHERE条件写法,避免索引失效,结合慢查询日志定位问题SQL,并根据查询模式合理设计索引。 当 MySQL 查询性能下降,很可能是索引未命中导致的。要分析这类问题,核心是理解查询执行计划、检查索引设计是否合理,并结合实际数据访问模式进行优…

    2025年12月6日 数据库
    000

发表回复

登录后才能评论
关注微信