位置:科技大田大数据产业专题>>资讯>>市场>>内容阅读
Ian Goodfellow发推讲2个机器学习黑魔法,教你如何推导公式
《深度学习》(花书)作者Ian Goodfellow今早连发了10条推特,细数了他最喜欢的两个机器学习“黑魔法”。他在著名的GAN论文中使用这两个小窍门推导了公式。 《深度学习》(花书)作者Ian Goodfellow今早连发了10条推特,细数了他最喜欢的两个机器学习“黑魔法”。他在著名的GAN论文中使用这两个小窍门推导了公式。

最后,他还不忘操心大家的学习,推荐了一本关于凸优化的书。当然,更详尽的操作还是要去看Goodfellow本人的《深度学习》。

Goodfellow称,这是关于机器学习,他最喜欢的两个快速理解理论推导的“黑魔法”。

以下是Ian Goodfellow推特内容:

很多时候,我们用代数或微积分来分析神经网络的最优行为。想实现一些函数的权重衰减或许可以用代数方法实现,但想要用代数方法解决神经网络中大多数函数的参数优化问题就有些过于复杂。

为了得到一个不太复杂的模型,常见的方法就是使用线性模型,因为线性模型能很好的解决凸优化问题。但线性模型又过于简单,其模型效果远不及神经网络。

黑魔法1:将神经网络视为一个任意函数,因此可以在同一空间优化所有的函数f,而不是特定的神经网络结构的参数theta。与使用参数和特定结构模型相比,这种方法非常简洁。

将神经网络视为一个函数,保留了线性模型的诸多优点:多种凸函数问题。例如,分类器的交叉熵损失在函数空间中就是一个凸优化问题。

这个假设并不准确,特别是与线性模型相比。但是根据通用逼近定理,神经网络可以较好地近似任意函数。

黑魔法2:如果你在同一空间优化所有函数时遇到困难,可以将函数想象成一个高维向量的分量。此时,关于R^n中x的评估函数f(x),就变成了在一个向量中查找f_x,其中x是对分量的索引。

通过这种方式,对函数进行优化就变成了一个常规微积分问题。这种方法很直观,但不是100%准确。有关更多正式版本和关于何时可以使用的限制信息,请参阅:

这篇论文中我的共同作者和我使用黑魔法破解#1和#2来推导GAN论文的eq 2链接如下:

最后的Bonus:推荐了这本凸优化书在斯坦福的pdf版本。

https://web.stanford.edu/~boyd/cvxbook/bv_cvxbook.pdf

免责声明:本网站部 分文章和信息来源于互联网,本网转载出于传递更多信息和学习之目的,并不意味着赞同其观点或证实其内容的真实性。如转载稿涉及版权等问题,请立即联系管理 员,我们会予以更改或删除相关文章,保证您的权利。对使用本网站信息和服务所引起的后果,本网站不作任何承诺。
Copyright 版权所有 Copyright 2013-2014 福建省云创集成科技服务有限公司
All Rights Reserved. 运营维护:三明市明网网络信息技术有限公司 业务咨询:0598-8233595 0598-5831286 技术咨询:0598-8915168