我在咖啡中有一个完全卷积网络(特别是堆叠沙漏网络)。在每个卷积层之后,我有一个批量归一化、一个缩放层和一个 ReLU 层。然而,我遇到了过度拟合的问题。通常,我会增加我的数据集(这是不可能的)或者我会使用 Dropout 层,但由于我读到在全卷积网络中使用 Dropout 层没有用,我不知道如何解决这个问题。除了我提到的以外还有什么要做的吗?在这种情况下正则化可能有帮助吗?
这是我从互联网上偷来的一张方便的图片。这是一个方便的图表,列出了当您的深度学习模型遇到问题时可以尝试的事情。你说你听说Dropout在Conv中不好,但是你测试过吗?从那开始并继续进行:
2020/10/22 更新- 经过几年的卷积编码并尝试了为什么我的嵌入层似乎具有不合理的高协方差问题的原因,我已将其追踪到丢失。 Dropout 会鼓励协方差(顺便说一句,这不好)。我没有使用 dropout,而是使用其他正则化器,或者完全跳过正则化并专注于初始化和架构。这是我制作的一个(糟糕的)视频,展示了如何有效地训练超深400 层卷积以及用于帮助其训练和运行的技巧
| 归档时间: |
|
| 查看次数: |
3087 次 |
| 最近记录: |