On the Spectral Bias of Neural Networks论文阅读 - 代码天地

On the Spectral Bias of Neural Networks论文阅读

物联网 2024-02-10 20:39:19 阅读次数: 0

1. 摘要

众所周知，过度参数化的深度神经网络(DNNs)是一种表达能力极强的函数，它甚至可以以100%的训练精度记忆随机数据。这就提出了一个问题，为什么他们不能轻易地对真实数据进行拟合呢。为了回答这个问题，研究人员使用傅里叶分析来研究深层网络。他们证明了具有有限权值(或训练有限步长)的深度网络天生偏向于表示输入空间上的平滑函数。具体地说，深度ReLU网络函数的特定频率分量(k)的衰减速度至少与O(k^2)一样快，宽度和深度分别以多项式和指数的方式帮助建模更高的频率。例如，这说明了为什么DNNs不能完美地记忆峰形三角函数。他们还表明，DNNs可以利用低维数据流形的几何形状，用简单函数近似流形上存在的复杂函数。因此，研究人员发现，所有被网络分类为属于某一类的样本(包括对抗本)都通过一条路径连接，这样网络沿着那条路径的预测就不会改变。最后，一般来说高频分量函数所对应的神经网络参数所占比重较小，这有助于正则化与抗过拟合。

2. 引言

低频信息指的是颜色缓慢变化，代表着连续渐变的一块区域，这部分为低频信息。对于一副图像来说，除去高频就是低频，也就是边缘以内的内容为低频，而边缘内的内容就是图像的大部分信息，即图像的大致概貌和轮廓，是图像的近似信息。

反之，图像边缘的灰度值变化快，就对应着高频。图像的细节处也就是属于灰度值急剧变化的区域，正是因为灰度值的急剧变化，才会出现细节。另外对于噪声，在一个像素所在的位置，之所以是噪点，是因为它与正常的点颜色不一样了，也就是说该像素点灰度值明显不一样，所以是高频部分。

通常，图像的低频是图像中对象的大致概况内容，高频对应噪声和细节。神经网络更倾向于拟合高频信息，而人类主要关注低频信息，然而对低频分量的学习，更有助于网络提高在对抗干扰过程中的鲁棒性。

主要贡献：

利用连续分段线性结构对ReLU网络的傅里叶谱分量进行分析。
发现了谱分量偏差（Spectrum bias）的经验证据，来源于低频分量，然而对低频分量的学习，有助于网络在对抗干扰过程中的鲁棒性。
通过流形理论，给予学习理论框架分析。

3. 实验结果

参考文献

On the Spectral Bias of Neural Networks

On the Spectral Bias of Deep Neural Networks笔记 - 知乎

去芜存三菁，On Spectral Bias of Deep Neural Networks精读上 - 知乎

猜你喜欢

转载自blog.csdn.net/xhtchina/article/details/134287859

On the Spectral Bias of Neural Networks论文阅读

role-of-bias-in-neural-networks

《Convolutional Neural Networks on Graphs with Fast Localized Spectral Filtering》阅读笔记

MUNN：Mutation Analysis of neural networks论文阅读

【论文阅读】Sequence to Sequence Learning with Neural Networks

【论文阅读】Non-local Neural Networks

『论文阅读』：Convolutional Neural Networks for Sentence Classification

Non-local Neural Networks论文阅读

SPECTRAL NORMALIZATION FOR GENERATIVE ADVERSARIAL NETWORKS阅读记录

【论文阅读】Ensembling Neural Networks for Digital Pathology Images Classification and Segmentation

Online Adaptation of Convolutional Neural Networks for Video Object Segmentation论文阅读

【论文阅读笔记】---《A Survey of Model Compression and Acceleration for Deep Neural Networks》

Relational recurrent neural networks 论文代码阅读及实现例子

【论文阅读笔记】Deep Neural Networks for Object Detection

《GATED GRAPH SEQUENCE NEURAL NETWORKS》结合代码的论文阅读笔记

【论文阅读笔记】-《Quantized Convolutional Neural Networks for Mobile Devices》

【论文阅读】Siamese Neural Networks for One-shot Image Recognition

Training Neural Networks with Weights and Activations Constrained to +1 or -1论文阅读

【论文阅读】Compressing Deep Neural Networks with Pruning, Trained Quantization and Huffma

《2017-Aggregated Residual Transformations for Deep Neural Networks》论文阅读

【论文阅读】Clustering Convolutional Kernels to Compress Deep Neural Networks

论文阅读-(CVPR 2017) Kernel Pooling for Convolutional Neural Networks

【论文阅读】Aggregated Residual Transformations for Deep Neural Networks Saining（ResNext）

【论文阅读】Bag of Tricks for Image Classification with Convolutional Neural Networks

Learning bothWeights and Connections for Efficient Neural Networks 论文阅读

论文阅读：Learning Compact Binary Descriptors with Unsupervised Deep Neural Networks

【ICML论文阅读】EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks

【ICML论文阅读】EfficientNet: Rethinking Model Scaling for Convolutional Neural Networks

【论文阅读】Gradient Centralization: A New Optimization Technique for Deep Neural Networks

论文阅读 | Augmenting Neural Networks with First-order Logic

今日推荐

火速冲上 GitHub 热榜 —— 开源编程语言、框架哪有这么可爱？

北京人形机器人创新中心发布全球首个纯电驱拟人奔跑的全尺寸人形机器人“天工”

LFOSSA 源来如此公开课 | 掌握云原生未来：CNCF 认证全面攻略与备考秘籍

国产云输入法——仅华为无云端数据上传安全问题

开源日报 | 工业开源项目OGG 1.0；姐姐，你要和我一起配置火狐吗；苹果AI遥遥落后？Fedora 40

开放签电子签章：停止新增，优化体验，前进更进（五一假期前工作）

开源日报 | 中学生开源前端动画引擎；全球首个Llama3 8B中文版开源模型；联想电脑恐出局；Linus讽刺AI炒作

周排行

浏览器对同一域名进行请求的最大并发连接数

React Hook之自定义Hook

【转】MyBatis缓存机制

-Java-泛型

自动化测试常用脚本-发送邮件

LeetCode#859: Buddy Strings

java、Python处理字符串

第二篇の博客

Hadoop伪分布式环境安装

SQL Server进阶（十一）临时表、表变量

每日归档

更多

2024-04-27(56)

2024-04-26(39)

2024-04-25(22)

2024-04-24(36)

2024-04-23(26)

2024-04-22(39)

2024-04-21(0)

2024-04-20(6)

2024-04-19(5)

2024-04-18(0)