百度360必应搜狗淘宝本站头条
当前位置:网站首页 > IT技术 > 正文

剑桥大学等研究发现:理论上稳定准确深度神经网络实际不存在

wptr33 2025-02-28 17:40 19 浏览

澎湃新闻记者 邵文

当下,深度神经网络应用越来越广泛,帮助设计微芯片,预测蛋白质折叠,并在复杂游戏中胜过人类,性能越来越强大。但也有大量证据证明,它们通常是不稳定的。一个非常明显的表现是,深度神经网络接收到的数据的微小变化,就可能会导致结果的巨大变化。

例如《One pixel attack for fooling deep neural networks》研究中所揭示的,改变图像上的一个像素,AI就把马识别成青蛙。哈佛医学院计算机科学家和生物医学信息学家Samuel Finlayson也曾发现,医学影像可以以人眼无法察觉的方式进行修改,然后导致人工智能100%地误诊癌症。

在以前的研究中,有数学证据表明,存在用于解决各种问题的稳定、准确的神经网络。然而最近剑桥大学和奥斯陆大学的研究人员发现,这些人工智能系统可能仅在有限的情况下是稳定和准确的。理论上存在的兼具稳定性和准确性的神经网络,可能无法准确描述现实中可能发生的事情。

“从理论上讲,神经网络的限制很少。”英国剑桥大学的数学家Matthew Colbrook 说。然而当试图计算这些神经网络时,问题就出现了。

“数字计算机只能计算某些特定的神经网络,”挪威奥斯陆大学的数学家Vegard Antun认为,“有时计算一个理想的神经网络是不可能的。”

这样的表述可能听起来令人困惑,《IEEE Spectrum》在谈论这项研究时以蛋糕做比喻,“好像有人说可能存在一种蛋糕,但不存在制作它的配方。”

“我们会说问题不在于配方。相反,问题在于制作蛋糕所必须的工具。”剑桥大学的数学家Anders Hansen说,“我们说可能有蛋糕的配方,但无论你有什么搅拌机,你都可能无法制作出想要的蛋糕。此外,当你尝试在厨房用搅拌机制作蛋糕时,你会得到一个完全不同的蛋糕。”

依此,继续进行类比,“甚至在你尝试之前无法判断蛋糕是否不正确,然后为时已晚。”Colbrook 说,“然而,在某些情况下,你的搅拌机足以制作你想要的蛋糕,或者至少可以很好地近似于该蛋糕。”

这些关于神经网络局限性的新发现与数学家Kurt G?del和计算机科学家Alan Turing关于计算局限性的先前研究相呼应。粗略地说,他们揭示了“有些数学陈述永远无法被证明或反驳,还有一些基本的计算问题是计算机无法解决的。”Antun表示。

此项研究以《计算稳定准确的神经网络的难点:关于深度学习的障碍和Smale的第18个问题》(The difficulty of computing stable and accurate neural networks: On the barriers of deep learning and Smale’s 18th problem)为题,于3月16日发布在《美国国家科学院院刊》上。

在人工神经网络中,被称为“神经元”的组件被输入数据并协作解决问题,例如识别图像。神经网络反复调整各个神经元之间的联系,并查看由此产生的行为模式是否能更好地找到解决方案。随着时间推移,网络会发现哪些模式最适合计算结果。然后它采用这些作为默认值,模仿人脑中的学习过程。如果一个神经网络拥有多层神经元,它就被称为“深度”。

在以前的研究中,有数学证据表明,存在用于解决各种问题的稳定、准确的神经网络。然而,在这项新的研究中,研究人员现在发现,尽管理论上可能存在稳定、准确的神经网络来解决许多问题,但矛盾的是,实际上可能没有算法能够成功地计算它们。

这项新研究发现,无论算法可以访问多少数据或该数据的准确性,算法都可能无法针对给定问题计算出稳定、准确的神经网络。Hansen表示,这类似于图灵的论点,即无论计算能力和运行时间如何,计算机都可能无法解决一些问题。

“计算机可以实现的功能存在固有的限制,这些限制也会出现在AI中,”Colbrook 表示,“这意味着理论上存在的具有良好特性的神经网络,可能无法准确描述现实中可能发生的事情。”

这些新发现并不表明所有神经网络都存在完全缺陷,但它们可能仅在有限的情况下是稳定和准确的。“在某些情况下,可以计算出稳定且准确的神经网络,”Antun说道,“关键问题是‘在某些情况下’的部分,最大的问题是找到这些案例。目前,人们对如何做到这一点知之甚少。”

研究人员发现,神经网络的稳定性和准确性之间经常需要权衡。“问题是我们同时想要稳定性和准确性,”Hansen说道,“在实践中,对于安全相关的关键应用,人们可能不得不牺牲一些准确性来确保稳定性。”

作为新研究的一部分,研究人员开发了他们“快速迭代重启网络”(FIRENET),以期在涉及分析医学图像等任务时实现,神经网络可以提供稳定性和准确性的结果。

研究人员认为,这些关于神经网络局限性的新发现并不是为了抑制人工智能研究,“从长远来看,弄清楚什么可以做和什么不可以做什么对人工智能研究来说是健康的。请注意,图灵和G?del的负面结果引发了数学基础和计算机科学方面的巨大变化,这分别导致了现代计算机科学和现代逻辑的大部分发展。”Colbrook说,

具体而言在这项研究中,研究人员认为,这些新发现意味着存在一种分类理论,其可以描述哪些具有给定精度的稳定神经网络可以通过算法进行计算。用之前谈到的蛋糕类比,“这将是一个分类理论,描述了哪些蛋糕可以用物理上可能设计的搅拌机烘烤。如果无法烘烤蛋糕,我们也想知道与想要的蛋糕类型有多接近。”Antun 说道。

责任编辑:李跃群

校对:张亮亮

相关推荐

oracle数据导入导出_oracle数据导入导出工具

关于oracle的数据导入导出,这个功能的使用场景,一般是换服务环境,把原先的oracle数据导入到另外一台oracle数据库,或者导出备份使用。只不过oracle的导入导出命令不好记忆,稍稍有点复杂...

继续学习Python中的while true/break语句

上次讲到if语句的用法,大家在微信公众号问了小编很多问题,那么小编在这几种解决一下,1.else和elif是子模块,不能单独使用2.一个if语句中可以包括很多个elif语句,但结尾只能有一个else解...

python continue和break的区别_python中break语句和continue语句的区别

python中循环语句经常会使用continue和break,那么这2者的区别是?continue是跳出本次循环,进行下一次循环;break是跳出整个循环;例如:...

简单学Python——关键字6——break和continue

Python退出循环,有break语句和continue语句两种实现方式。break语句和continue语句的区别:break语句作用是终止循环。continue语句作用是跳出本轮循环,继续下一次循...

2-1,0基础学Python之 break退出循环、 continue继续循环 多重循

用for循环或者while循环时,如果要在循环体内直接退出循环,可以使用break语句。比如计算1至100的整数和,我们用while来实现:sum=0x=1whileTrue...

Python 中 break 和 continue 傻傻分不清

大家好啊,我是大田。今天分享一下break和continue在代码中的执行效果是什么,进一步区分出二者的区别。一、continue例1:当小明3岁时不打印年龄,其余年龄正常循环打印。可以看...

python中的流程控制语句:continue、break 和 return使用方法

Python中,continue、break和return是控制流程的关键语句,用于在循环或函数中提前退出或跳过某些操作。它们的用途和区别如下:1.continue(跳过当前循环的剩余部分,进...

L017:continue和break - 教程文案

continue和break在Python中,continue和break是用于控制循环(如for和while)执行流程的关键字,它们的作用如下:1.continue:跳过当前迭代,...

作为前端开发者,你都经历过怎样的面试?

已经裸辞1个月了,最近开始投简历找工作,遇到各种各样的面试,今天分享一下。其实在职的时候也做过面试官,面试官时,感觉自己问的问题很难区分候选人的能力,最好的办法就是看看候选人的github上的代码仓库...

面试被问 const 是否不可变?这样回答才显功底

作为前端开发者,我在学习ES6特性时,总被const的"善变"搞得一头雾水——为什么用const声明的数组还能push元素?为什么基本类型赋值就会报错?直到翻遍MDN文档、对着内存图反...

2023金九银十必看前端面试题!2w字精品!

导文2023金九银十必看前端面试题!金九银十黄金期来了想要跳槽的小伙伴快来看啊CSS1.请解释CSS的盒模型是什么,并描述其组成部分。答案:CSS的盒模型是用于布局和定位元素的概念。它由内容区域...

前端面试总结_前端面试题整理

记得当时大二的时候,看到实验室的学长学姐忙于各种春招,有些收获了大厂offer,有些还在苦苦面试,其实那时候的心里还蛮忐忑的,不知道自己大三的时候会是什么样的一个水平,所以从19年的寒假放完,大二下学...

由浅入深,66条JavaScript面试知识点(七)

作者:JakeZhang转发链接:https://juejin.im/post/5ef8377f6fb9a07e693a6061目录由浅入深,66条JavaScript面试知识点(一)由浅入深,66...

2024前端面试真题之—VUE篇_前端面试题vue2020及答案

添加图片注释,不超过140字(可选)1.vue的生命周期有哪些及每个生命周期做了什么?beforeCreate是newVue()之后触发的第一个钩子,在当前阶段data、methods、com...

今年最常见的前端面试题,你会做几道?

在面试或招聘前端开发人员时,期望、现实和需求之间总是存在着巨大差距。面试其实是一个交流想法的地方,挑战人们的思考方式,并客观地分析给定的问题。可以通过面试了解人们如何做出决策,了解一个人对技术和解决问...