手机浏览器扫描二维码访问
当梯度太大时,参数的调整会变得过于剧烈,网络的学习变得不稳定,甚至会导致训练失败。
这就像你在陡峭的悬崖边滑落,一下子失去了控制。
网络的参数变化过大,导致结果变得很不稳定,甚至完全错误。
概括地说:
梯度消失就像在一座越来越平的山坡上,梯度变得很小,神经网络不知道该怎么调整,进而学习变得很慢,甚至无法进步。
梯度爆炸就像从悬崖边滚下去,梯度变得很大,网络的学习变得过于剧烈,结果会非常不稳定,训练过程变得不可控。
这两个问题经常会出现在深层神经网络中。
而这也是马库斯所要倾诉的困扰。
“说起来,最近的研究还卡在了‘梯度消失’的问题上。”马库斯苦笑着说道,靠在沙发上,“我们在训练一些更深层次的神经网络时,发现模型一旦超过一定的深度,反向传播算法中的梯度会逐渐趋近于零,根本无法有效更新权重。深度越大,梯度就越容易消失,整个网络的学习效率大幅下降。”
马库斯知道林枫硕士是麻省理工学院的计算机硕士,因此也就全都用专业术语表述了。
对于这些林枫当然能听明白,非但能听明白,而且作为一个资深的人工智能从业人员。
林枫也清楚知道马库斯面临的难题。
林枫对AI的发展也有所了解,涉及到梯度问题在2014年是深度学习研究中的一个巨大挑战。
甚至可以说解决不了梯度问题就很难有真正的深度学习,也就不会有后来的人工智能成果的一系列井喷。
林枫心说,自己这是一不小心站在了技术发展的最前沿了吗?
不得不说,这种举手投足之间就能影响时代命运的感觉是真的无比美妙。
“梯度消失的问题一直存在,尤其是深层网络。梯度爆炸倒是相对好解决,但梯度消失会直接导致学习过程停滞不前。”林枫沉思片刻,补充道,“这不仅是你们实验室的问题,也是整个领域的瓶颈。反向传播的基本原理决定了,当信号在网络中层层传递时,梯度的变化会以指数级缩小。”
马库斯脑海中泛起了大大的问号,梯度爆炸问题好解决吗?
他怎么觉得梯度爆炸问题也挺麻烦的?
不过聊天本来就是求同存异,既然林同样认为梯度消失难以解决就够了。
马库斯也没纠结为什么林说梯度爆炸容易解决,而是继续就梯度消失发表观点说道:“是啊,哪怕有了ReLU(修正线性单元)激活函数的引入,虽然能在一定程度上减轻梯度消失,但对深层网络还是不够。”
林枫想了想,说道:“你们有考虑过改进网络结构吗?”
喜欢不朽从二零一四开始请大家收藏:()不朽从二零一四开始
妖月悬空,开局觉醒双星核 百岁躺进棺材中,让我攻略女帝 假千金撬了男主他墙角 老婆请转身沈浪苏妙涵 鞠怡以的神影 我在快穿游戏里玩儿嗨了 和闺蜜穿七零,带着婆婆一起离 神耳偷仙,诡变求存 倚天:我从双修开始修炼成仙 被道侣分手后,系统终于来了! 红颜情殇之宫阙风云 我携山河画卷,穿越古今追光 春花秋月李三妮 一穿越就成断案高手 穿越后我在异世界娱乐圈爆红 碎婚 你帅,我靓,咱俩日子过得旺 重生之都市极品天尊 琪亚娜的万界之旅 血虹剑
音乐影视绘画书法雕塑文学你都懂?略知一二。都会一点的意思?嗯,都会亿点的意思。怀揣系统,靠艺术征服世界,成为各界人士顶礼膜拜的无冕之王。...
老公小青梅养的狗害两岁女儿得了狂犬病送医。渣老公却为了救他的小青梅和三只狗,延误了救女儿的黄金时间最终惨死医院。同一时间,婆婆的不看管,致使家里的大宝小宝溺死游泳池中。安抒抒痛失三个孩子,一夜白了头。从此,她褪下过去无用的温婉懂事,将自己磨炼成锋利见血的利刃,一刀一刀将恶人凌迟。葬礼上,缺失父爱的孩子们,到死也没等...
公元878年,唐僖宗乾符五年。这一年,王仙芝战死黄梅,部众推黄巢为主,号冲天大将军,转战南方。这一年,李克用杀大同军使段文楚,父子二人发动叛乱,沙陀兵马抄掠河东。这一年,江南盗贼蜂起,连陷州郡。这一年,河南连岁旱蝗,军士作乱。这一年,僖宗斗鸡击球,不理朝政。这一年,大唐风雨飘摇。这一年,后世穿越而来的邵树德有自己的...
关于抗战之血肉丛林岛寇荼毒,痛及滇西,谁无血气,忍弃边陲,桓桓将士,不顾艰危,十荡十决,甘死如饴,座中有圹,名勒丰碑,檩檩大义,昭示来兹。谨以此文献给曾经为了保卫国家出国在缅甸与倭寇决一死战的远征军将士们!历史不会忘记,中国人不会忘记,虽然你们曾经被记忆尘封,但是时间也绝不会让你们永远蒙尘!...
...
脆皮大学生李友仁玩着一款生存游戏时,一道绿光在头顶浮现,刺眼的绿光让李友仁闭紧双眼,感受到刺眼的光芒消失,李友仁已经来到了1958年。李友仁在这红火的年代面对历史的浪潮,他会如何过好自己的小日子呢。...