当前位置: 开发笔记 > 编程语言 > 正文

超全！19种损失函数，你能认识几个？

作者：手机用户2502855477 | 来源：互联网 | 2023-08-27 17:38

磐创AI分享来源|智能算法作者|mingo_敏编辑|深度学习自然语言处理小编zenRRan【导读】tensorflow和pytorch很多都是相似的，这里以pytor

磐创AI分享

来源 | 智能算法

作者 | mingo_敏

编辑 | 深度学习自然语言处理小编zenRRan

【导读】tensorflow和pytorch很多都是相似的&＃xff0c;这里以pytorch为例。

19种损失函数

1. L1范数损失 L1Loss

计算 output 和 target 之差的绝对值。

torch.nn.L1Loss(reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

reduction-三个值&＃xff0c;none: 不使用约简&＃xff1b;mean:返回loss和的平均值&＃xff1b;sum:返回loss的和。默认&＃xff1a;mean。

2 均方误差损失 MSELoss

计算 output 和 target 之差的均方差。

torch.nn.MSELoss(reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

reduction-三个值&＃xff0c;none: 不使用约简&＃xff1b;mean:返回loss和的平均值&＃xff1b;sum:返回loss的和。默认&＃xff1a;mean。

3 交叉熵损失 CrossEntropyLoss

当训练有 C 个类别的分类问题时很有效. 可选参数 weight 必须是一个1维 Tensor, 权重将被分配给各个类别. 对于不平衡的训练集非常有效。

在多分类任务中&＃xff0c;经常采用 softmax 激活函数&＃43;交叉熵损失函数&＃xff0c;因为交叉熵描述了两个概率分布的差异&＃xff0c;然而神经网络输出的是向量&＃xff0c;并不是概率分布的形式。所以需要 softmax激活函数将一个向量进行“归一化”成概率分布的形式&＃xff0c;再采用交叉熵损失函数计算 loss。

torch.nn.CrossEntropyLoss(weight&＃61;None,ignore_index&＃61;-100, reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

weight (Tensor, optional) – 自定义的每个类别的权重. 必须是一个长度为 C 的 Tensor
ignore_index (int, optional) – 设置一个目标值, 该目标值会被忽略, 从而不会影响到输入的梯度。
reduction-三个值&＃xff0c;none: 不使用约简&＃xff1b;mean:返回loss和的平均值&＃xff1b;sum:返回loss的和。默认&＃xff1a;mean。

4 KL 散度损失 KLDivLoss

计算 input 和 target 之间的 KL 散度。KL 散度可用于衡量不同的连续分布之间的距离, 在连续的输出分布的空间上(离散采样)上进行直接回归时很有效.

torch.nn.KLDivLoss(reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

reduction-三个值&＃xff0c;none: 不使用约简&＃xff1b;mean:返回loss和的平均值&＃xff1b;sum:返回loss的和。默认&＃xff1a;mean。

5 二进制交叉熵损失 BCELoss

二分类任务时的交叉熵计算函数。用于测量重构的误差, 例如自动编码机. 注意目标的值 t[i] 的范围为0到1之间.

torch.nn.BCELoss(weight&＃61;None, reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

weight (Tensor, optional) – 自定义的每个 batch 元素的 loss 的权重. 必须是一个长度为 “nbatch” 的的 Tensor

6 BCEWithLogitsLoss

BCEWithLogitsLoss损失函数把 Sigmoid 层集成到了 BCELoss 类中. 该版比用一个简单的 Sigmoid 层和 BCELoss 在数值上更稳定, 因为把这两个操作合并为一个层之后, 可以利用 log-sum-exp 的技巧来实现数值稳定.

torch.nn.BCEWithLogitsLoss(weight&＃61;None, reduction&＃61;&＃39;mean&＃39;, pos_weight&＃61;None)

参数&＃xff1a;

weight (Tensor, optional) – 自定义的每个 batch 元素的 loss 的权重. 必须是一个长度为 “nbatch” 的 Tensor

7 MarginRankingLoss

torch.nn.MarginRankingLoss(margin&＃61;0.0, reduction&＃61;&＃39;mean&＃39;)

对于 mini-batch(小批量) 中每个实例的损失函数如下:

参数&＃xff1a;

margin:默认值0

8 HingeEmbeddingLoss

torch.nn.HingeEmbeddingLoss(margin&＃61;1.0, reduction&＃61;&＃39;mean&＃39;)

对于 mini-batch(小批量) 中每个实例的损失函数如下:

参数&＃xff1a;

margin:默认值1

9 多标签分类损失 MultiLabelMarginLoss

torch.nn.MultiLabelMarginLoss(reduction&＃61;&＃39;mean&＃39;)

对于mini-batch(小批量) 中的每个样本按如下公式计算损失:

10 平滑版L1损失 SmoothL1Loss

也被称为 Huber 损失函数。

torch.nn.SmoothL1Loss(reduction&＃61;&＃39;mean&＃39;)

其中

11 2分类的logistic损失 SoftMarginLoss

torch.nn.SoftMarginLoss(reduction&＃61;&＃39;mean&＃39;)

12 多标签 one-versus-all 损失 MultiLabelSoftMarginLoss

torch.nn.MultiLabelSoftMarginLoss(weight&＃61;None, reduction&＃61;&＃39;mean&＃39;)

13 cosine 损失 CosineEmbeddingLoss

torch.nn.CosineEmbeddingLoss(margin&＃61;0.0, reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

margin:默认值0

14 多类别分类的hinge损失 MultiMarginLoss

torch.nn.MultiMarginLoss(p&＃61;1, margin&＃61;1.0, weight&＃61;None, reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

p&＃61;1或者2 默认值&＃xff1a;1
margin:默认值1

15 三元组损失 TripletMarginLoss

和孪生网络相似&＃xff0c;具体例子&＃xff1a;给一个A&＃xff0c;然后再给B、C&＃xff0c;看看B、C谁和A更像。

torch.nn.TripletMarginLoss(margin&＃61;1.0, p&＃61;2.0, eps&＃61;1e-06, swap&＃61;False, reduction&＃61;&＃39;mean&＃39;)

其中&＃xff1a;

16 连接时序分类损失 CTCLoss

CTC连接时序分类损失&＃xff0c;可以对没有对齐的数据进行自动对齐&＃xff0c;主要用在没有事先对齐的序列化数据训练上。比如语音识别、ocr识别等等。

torch.nn.CTCLoss(blank&＃61;0, reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

reduction-三个值&＃xff0c;none: 不使用约简&＃xff1b;mean:返回loss和的平均值&＃xff1b;sum:返回loss的和。默认&＃xff1a;mean。

17 负对数似然损失 NLLLoss

负对数似然损失. 用于训练 C 个类别的分类问题.

torch.nn.NLLLoss(weight&＃61;None, ignore_index&＃61;-100, reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

weight (Tensor, optional) – 自定义的每个类别的权重. 必须是一个长度为 C 的 Tensor
ignore_index (int, optional) – 设置一个目标值, 该目标值会被忽略, 从而不会影响到输入的梯度.

18 NLLLoss2d

对于图片输入的负对数似然损失. 它计算每个像素的负对数似然损失.

torch.nn.NLLLoss2d(weight&＃61;None, ignore_index&＃61;-100, reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

weight (Tensor, optional) – 自定义的每个类别的权重. 必须是一个长度为 C 的 Tensor
reduction-三个值&＃xff0c;none: 不使用约简&＃xff1b;mean:返回loss和的平均值&＃xff1b;sum:返回loss的和。默认&＃xff1a;mean。

19 PoissonNLLLoss

目标值为泊松分布的负对数似然损失

torch.nn.PoissonNLLLoss(log_input&＃61;True, full&＃61;False, eps&＃61;1e-08, reduction&＃61;&＃39;mean&＃39;)

参数&＃xff1a;

log_input (bool, optional) – 如果设置为 True , loss 将会按照公式 exp(input) - target * input 来计算, 如果设置为 False , loss 将会按照 input - target * log(input&＃43;eps) 计算.
full (bool, optional) – 是否计算全部的 loss, i. e. 加上 Stirling 近似项 target * log(target) - target &＃43; 0.5 * log(2 * pi * target).
eps (float, optional) – 默认值: 1e-8

参考资料&＃xff1a;

pytorch loss function 总结

http://www.voidcn.com/article/p-rtzqgqkz-bpg.html

原文链接&＃xff1a;https://blog.csdn.net/shanglianlm/article/details/85019768

- End -

欢迎扫码关注&＃xff1a;

推荐阅读

process
从2019年AI顶级会议最佳论文，探索深度学习的理论根基与前沿进展

从2019年AI顶级会议最佳论文，探索深度学习的理论根基与前沿进展 ... [详细]

蜡笔小新 2024-11-03 10:42:12
sum
利用CIFAR10数据集快速掌握Mixup数据增强技术，显著提高图像分类精度

通过使用CIFAR-10数据集，本文详细介绍了如何快速掌握Mixup数据增强技术，并展示了该方法在图像分类任务中的显著效果。实验结果表明，Mixup能够有效提高模型的泛化能力和分类精度，为图像识别领域的研究提供了有价值的参考。 ... [详细]

蜡笔小新 2024-11-05 14:24:36
process
利用OpenCV和线性SVM实现人脸识别

本文介绍如何使用OpenCV和线性支持向量机（SVM）模型来开发一个简单的人脸识别系统，特别关注在只有一个用户数据集时的处理方法。 ... [详细]

蜡笔小新 2024-11-13 14:50:37
go
Python 数据可视化实战指南

本文详细介绍如何使用 Python 进行数据可视化，涵盖从环境搭建到具体实例的全过程。 ... [详细]

蜡笔小新 2024-11-13 06:03:30
go
机器学习的持续探索与进展

在机器学习领域，深入探讨了概率论与数理统计的基础知识，特别是这些理论在数据挖掘中的应用。文章重点分析了偏差（Bias）与方差（Variance）之间的平衡问题，强调了方差反映了不同训练模型之间的差异，例如在K折交叉验证中，不同模型之间的性能差异显著。此外，还讨论了如何通过优化模型选择和参数调整来有效控制这一平衡，以提高模型的泛化能力。 ... [详细]

蜡笔小新 2024-11-11 10:27:39
sum
【图像分类实战】利用DenseNet在PyTorch中实现秃头识别

本文详细介绍了如何使用DenseNet模型在PyTorch框架下实现秃头识别。首先，文章概述了项目所需的库和全局参数设置。接着，对图像进行预处理并读取数据集。随后，构建并配置DenseNet模型，设置训练和验证流程。最后，通过测试阶段验证模型性能，并提供了完整的代码实现。本文不仅涵盖了技术细节，还提供了实用的操作指南，适合初学者和有经验的研究人员参考。 ... [详细]

蜡笔小新 2024-11-06 15:21:35
list
能够感知你情绪状态的智能机器人即将问世 | 科技前沿观察

本周科技前沿报道了多项重要进展，包括美国多所高校在机器人技术和自动驾驶领域的最新研究成果，以及硅谷大型企业在智能硬件和深度学习技术上的突破性进展。特别值得一提的是，一款能够感知用户情绪状态的智能机器人即将问世，为未来的人机交互带来了全新的可能性。 ... [详细]

蜡笔小新 2024-11-05 20:45:31
go
基于OpenCV的图像拼接技术实践与示例代码解析

图像拼接技术在全景摄影中具有广泛应用，如手机全景拍摄功能，通过将多张照片根据其关联信息合成为一张完整图像。本文详细探讨了使用Python和OpenCV库实现图像拼接的具体方法，并提供了示例代码解析，帮助读者深入理解该技术的实现过程。 ... [详细]

蜡笔小新 2024-11-03 12:48:59
go
超分辨率技术的全球研究进展与应用现状综述

本文综述了图像超分辨率（Super-Resolution, SR）技术在全球范围内的最新研究进展及其应用现状。超分辨率技术旨在从单幅或多幅低分辨率（Low-Resolution, LR）图像中恢复出高质量的高分辨率（High-Resolution, HR）图像。该技术在遥感、医疗成像、视频处理等多个领域展现出广泛的应用前景。文章详细分析了当前主流的超分辨率算法，包括基于传统方法和深度学习的方法，并探讨了其在实际应用中的优缺点及未来发展方向。 ... [详细]

蜡笔小新 2024-10-31 15:10:48
go
视觉图像的生成机制与英文术语解析

近期，Google Brain、牛津大学和清华大学等多家研究机构相继发布了关于多层感知机（MLP）在视觉图像分类中的应用成果。这些研究深入探讨了MLP在视觉任务中的工作机制，并解析了相关技术术语，为理解视觉图像生成提供了新的视角和方法。 ... [详细]

蜡笔小新 2024-10-30 09:47:50
text
2019年斯坦福大学CS224n课程笔记：深度学习在自然语言处理中的应用——Word2Vec与GloVe模型解析

本文详细解析了2019年斯坦福大学CS224n课程中关于深度学习在自然语言处理（NLP）领域的应用，重点探讨了Word2Vec和GloVe两种词嵌入模型的原理与实现方法。通过具体案例分析，深入阐述了这两种模型在提升NLP任务性能方面的优势与应用场景。 ... [详细]

蜡笔小新 2024-10-29 10:37:07
main
表面缺陷检测数据集综述及GitHub开源项目推荐

本文综述了表面缺陷检测领域的数据集，并推荐了多个GitHub上的开源项目。通过对现有文献和数据集的系统整理，为研究人员提供了全面的资源参考，有助于推动该领域的发展和技术进步。 ... [详细]

蜡笔小新 2024-10-29 08:22:46
list
PyTorch常见预训练模型的下载链接及使用指南

本文提供了PyTorch框架中常用的预训练模型的下载链接及详细使用指南，涵盖ResNet、Inception、DenseNet、AlexNet、VGGNet等六大分类模型。每种模型的预训练参数均经过精心调优，适用于多种计算机视觉任务。文章不仅介绍了模型的下载方式，还详细说明了如何在实际项目中高效地加载和使用这些模型，为开发者提供全面的技术支持。 ... [详细]

蜡笔小新 2024-10-27 13:57:42
sum
每日学术推荐：异质图神经网络在抽取式文档摘要中的应用研究

在抽取式文档摘要任务中，学习跨句子关系是至关重要的一步。本文探讨了利用异质图神经网络来捕捉句子间复杂关系的有效方法。通过构建包含不同类型节点和边的图结构，模型能够更准确地识别和提取关键信息，从而生成高质量的摘要。实验结果表明，该方法在多个基准数据集上显著优于传统方法。 ... [详细]

蜡笔小新 2024-11-06 13:02:39
go
深入解析经典卷积神经网络及其实现代码

深入解析经典卷积神经网络及其实现代码 ... [详细]

蜡笔小新 2024-11-01 11:16:09

手机用户2502855477

这个家伙很懒，什么也没留下！

Tags | 热门标签

RankList | 热门文章