多层感知器

✍ dations ◷ 2025-07-14 23:16:29 #多层感知器

多层感知器(Multilayer Perceptron,缩写MLP)是一种前向结构的人工神经网络,映射一组输入向量到一组输出向量。MLP可以被看作是一个有向图,由多个的节点层所组成,每一层都全连接到下一层。除了输入节点,每个节点都是一个带有非线性激活函数的神经元(或称处理单元)。一种被称为反向传播算法的监督学习方法常被用来训练MLP。 多层感知器遵循人类神经系统原理,学习并进行数据预测。它首先学习,然后使用权重存储数据,并使用算法来调整权重并减少训练过程中的偏差,即实际值和预测值之间的误差。主要优势在于其快速解决复杂问题的能力。多层感知的基本结构由三层组成:第一输入层,中间隐藏层和最后输出层,输入元素和权重的乘积被馈给具有神经元偏差的求和结点,主要优势在于其快速解决复杂问题的能力。 MLP是感知器的推广,克服了感知器不能对线性不可分数据进行识别的弱点。

若每个神经元的激活函数都是线性函数,那么,任意层数的MLP都可被约简成一个等价的单层感知器。

实际上,MLP本身可以使用任何形式的激活函数,譬如阶梯函数逻辑Sigmoid函数,但为了使用反向传播算法进行有效学习,激活函数必须限制为可微函数。由于具有良好可微性,很多S函数,尤其是双曲正切函数(Hyperbolic tangent)及逻辑函数,被采用为激活函数。

在深度学习的最新发展中,线性整流(ReLU)更频繁地被用来克服与S函数相关的数值问题。

两个历史上常见的激活函数都是 S函数,形式是

y ( v i ) = tanh ( v i ) {displaystyle y(v_{i})=tanh(v_{i})} y ( v i ) = ( 1 + e v i ) 1 {displaystyle y(v_{i})=(1+e^{-v_{i}})^{-1}}

第一个是个双曲正切函数,值域为 -1 到 1;第二个是个逻辑函数,形状很相似但是值域为 0 到 1。令 yi 为第 i 个节点(神经元)的输出,而 vi 是输入连接的加权和。也有其他的激活函数,例如线性整流函数,径向基函数(用于径向基函数网络,另一种监督神经网络模型)。

MLP由三层或更多层非线性激活节点组成(一个输入层和一个具有一个或多个隐藏层的输出层)。由于多层互连是完全连接的,所以一层中的每个节点都以一定的权重 wij 连接到下一层的每个节点。

MLP 在感知器中进行学习,通过每次处理数据后改变连接权重,降低输出与预测结果的误差量。这是有监督学习的一个例子,通过反向传播来实现,反向传播是线性感知器中最小均方算法的推广。

我们可以将输出节点 j 的第 n 个数据点的误差表示为 e j ( n ) = d j ( n ) y j ( n ) {displaystyle e_{j}(n)=d_{j}(n)-y_{j}(n)} ,其中 d 是目标值,y 是由感知器预测的值。调整节点权重的方式是,尝试通过修正节点权重最小化输出的整体误差

使用梯度下降,每个权重的修正量为

其中 yi 是前一个神经元的输出,η是学习率。η需要精心挑选,保证权重可以快速收敛而不发生震荡。

式中的导数取决于局部场 vj。场是变化的。很容易证明输出节点的导数可以简化为

其中 ϕ {displaystyle phi ^{prime }} 是激活函数的导数。 ϕ {displaystyle phi ^{prime }} 是不变的。对于隐藏节点的权重变化,分析更加困难,但是可以看出相关的导数是

代表输出层的第k个节点的权重变化会影响这个导数。因此,为了改变隐藏层权重,输出层权重根据激活函数的导数而改变,因此该算法代表激活函数的反向传播。

术语“多层感知器”不是指具有多层的单感知器,每一层由多个感知器组成。另一种说法是是“多层感知器网络”。此外,MLP的“感知器”不是最严格意义上的感知器。真正的感知器在形式上是人工神经元的一个特例,它使用一个阈值激活函数,如阶跃函数。MLP感知器可以使用任意激活函数。一个真正的感知器执行二进制分类(或者这个或者那个),一个MLP神经元可以自由地执行分类或者回归,这取决于它的激活函数。

后来应用术语“多层感知器”时,没有考虑节点/层的性质,节点/层可以由任意定义的人工神经元组成,而不是具体的感知器。这种解释避免了将“感知器”的定义放宽到一般意义上的人工神经元。

常被MLP用来进行学习的反向传播算法,在模式识别的领域中算是标准监督学习算法,并在计算神经学及并行分布式处理领域中,持续成为被研究的课题。MLP已被证明是一种通用的函数近似方法,可以被用来拟合复杂的函数,或解决分类问题。

MLP在80年代的时候曾是相当流行的机器学习方法,拥有广泛的应用场景,譬如语音识别、图像识别、机器翻译等等,但自90年代以来,MLP遇到来自更为简单的支持向量机的强劲竞争。近来,由于深度学习的成功,MLP又重新得到了关注。

相关

  • 1993年 布法罗第十七届夏季世界大学生运动会于1993年7月8日至7月18日在美国纽约州水牛城举行。共有来自117个国家,一共5105名运动员参加。*  主办国家/地区(美国)
  • 日本时报日本时报(The Japan Times,ジャパンタイムズ)是一家总部位于日本东京都港区、专办英文报纸与英文杂志书籍等出版品的报社。创刊于1897年的日本时报,是日本现存的英文报纸中历史
  • 中华民国汽车客运业者列表公路总局 民用航空局 高速公路局 航港局 铁道局 台湾铁路管理局 中华邮政公司 台湾港务公司 桃园国际机场公司国道 省道 县道 - 市道(列表) 乡道 - 区道 专用公路 编号与名称
  • 凯奥克他达区凯奥克他达区(缅甸语:ကျောက်တံတားမြို့နယ်;;英语:Kyauktada Township)为缅甸仰光省仰光市的镇区。2014年人口29,853人,区域面积0.70平方公里。凯奥克他达区下分
  • 饶思聪饶思聪(1506年-1555年),字子闻,号湖田,江西新干(今界埠乡湖田村)人。明朝政治人物。江西乡试第七十四名举人。嘉靖八年(1529年)中式己丑科进士。任保定府(今河北保定市)推官。升刑部主事
  • 应浩应浩 (1958年-) 是一位计算机工程师,智能控制,人工神经网络专家。1982年获得东华大学电子工程学士学位,1984年获得东华大学计算机工程硕士学位,1990年获得阿拉巴马大学伯明翰分校
  • 安嫔 (嘉庆帝)安嫔(1785年3月1日-1837年7月29日),苏完瓜尔佳氏,满洲镶黄旗人。原任一等信勇公、二等侍卫安英之女,乌里苏台将军福兴之孙女,开国功臣费英东嫡系后代。清朝嘉庆帝之嫔。乾隆五十年
  • 超感8人组《超感8人组》(英语:,“sensate”的谐音,/ˈsɛnseɪt/,意为“知觉的”)是一部由沃卓斯基姐妹和约瑟夫·迈克尔·斯特拉日恩斯基为Netflix创作的美国科幻剧情(英语:Drama (film and
  • 阿贝拉尔多·奥利维耶阿贝拉尔多·奥利维耶(意大利语:Abelardo Olivier,1877年11月9日-1951年1月24日),意大利男子击剑运动员。他曾获得1908年夏季奥运会男子佩剑团体银牌,1920年夏季奥运会男子花剑团体
  • 大部由美大部由美(日语:大部 由美/おおべ ゆみ ,1975年2月15日-),日本足球运动员,日本国家女子足球队成员。在1991年8月21日,她代表日本国家女子足球队出赛,在对战中国的比赛中首次​​亮相。