当前位置: 开发笔记 > 后端 > 正文

172篇文献：NUS颜水成等发布首篇《深度长尾学习》综述

作者：asdvuj | 来源：互联网 | 2023-07-16 12:59

来源丨新智元编辑丨极市平台导读深度学习依赖于大量数据，但对于长尾类别来说，数据样本较为稀缺。为此，深度长尾学习从大量遵循长尾类分布的图像中

来源丨新智元

编辑丨极市平台

导读

深度学习依赖于大量数据&＃xff0c;但对于长尾类别来说&＃xff0c;数据样本较为稀缺。为此&＃xff0c;深度长尾学习从大量遵循长尾类分布的图像中训练出性能良好的深度模型&＃xff0c;得到大量研究。来自NUS的颜水成等学者发布了首篇《深度长尾学习》综述论文&＃xff0c;值得关注&＃xff01;

论文链接&＃xff1a;https://arxiv.org/abs/2110.04596

摘要

深度长尾学习是视觉识别中最具挑战性的问题之一&＃xff0c;其目标是从大量遵循长尾类分布的图像中训练出性能良好的深度模型。在过去的十年中&＃xff0c;深度学习已经成为一种学习高质量图像表示的强大的识别模型&＃xff0c;并导致了一般视觉识别的显著突破。

然而&＃xff0c;长尾类不平衡是实际视觉识别任务中普遍存在的问题&＃xff0c;这种不平衡往往限制了基于深度网络的识别模型在实际应用中的实用性&＃xff0c;因为长尾类容易偏向主导类&＃xff0c;在尾类上的表现较差。

为了解决这一问题&＃xff0c;近年来人们进行了大量的研究&＃xff0c;在深度长尾学习领域取得了可喜的进展。鉴于该领域的快速发展&＃xff0c;本文对深度长尾学习的最新进展进行了综述。

具体地说&＃xff0c;我们将已有的深度长尾学习研究分为三类(即类重平衡、信息增强和模块改进)&＃xff0c;并根据这三类对这些方法进行了详细的回顾。

之后&＃xff0c;我们通过一种新提出的评价指标&＃xff0c;即相对准确性&＃xff0c;来评估它们在多大程度上解决了阶级失衡问题&＃xff0c;从而对几种最先进的方法进行了实证分析。

最后&＃xff0c;我们强调了深度长尾学习的重要应用&＃xff0c;并确定了未来研究的几个有前景的方向。

引言

深度学习允许由多个处理层组成的计算模型学习具有多级抽象的数据表示&＃xff0c;并在计算机视觉任务方面取得了令人难以置信的进展。

深度学习的关键因素是大规模数据集的可用性、GPU的出现和深度网络架构[9]的进步。深度神经网络具有很强的学习高质量数据表示的能力&＃xff0c;在图像分类、目标检测和语义分割等视觉识别任务中取得了巨大的成功。

在实际应用中&＃xff0c;训练样本通常表现为长尾类分布&＃xff0c;其中一小部分类有大量的样本点&＃xff0c;而其他类只与少数样本相关。然而&＃xff0c;这种训练样本数量的类不平衡&＃xff0c;使得基于深度网络的识别模型的训练非常具有挑战性。如图1所示&＃xff0c;训练后的模型容易偏向训练数据量大的头类&＃xff0c;导致模型在数据量有限的尾类上表现不佳。

因此&＃xff0c;经验风险最小化常用实践训练的深度模型无法处理长尾类不平衡的现实应用&＃xff0c;如人脸识别&＃xff0c;物种分类&＃xff0c;医学图像诊断&＃xff0c;城市场景理解&＃xff0c;无人机检测等。

针对长尾类的不平衡&＃xff0c;近年来开展了大量的深度长尾学习研究。尽管这一领域发展迅速&＃xff0c;但仍没有系统的研究来回顾和讨论现有的进展。

为了填补这一空白&＃xff0c;我们旨在对2021年年中之前进行的近期长尾学习研究进行全面综述。

如图2&＃xff08;下图&＃xff09;所示&＃xff0c;我们根据现有方法的主要技术贡献将其分为三类&＃xff0c;即类重平衡、信息增强和模块改进; 这些类别可以进一步分为九个子类别:重采样、代价敏感学习、logit调整、迁移学习、数据增强、表示学习、分类器设计、解耦训练和集成学习。

根据这一分类&＃xff0c;我们对现有的方法进行了全面的回顾&＃xff0c;并对几种最先进的方法进行了实证分析&＃xff0c;使用一个新的评价指标&＃xff0c;即相对准确性来评价它们处理类不平衡的能力。我们通过介绍几个真实的深度长尾学习的应用场景&＃xff0c;并确定了几个有前景的研究方向&＃xff0c;可以由社区在未来探索。

我们总结了这项综述的主要贡献如下。

• 据我们所知&＃xff0c;这是第一次对深度长尾学习的全面调研&＃xff0c;将为研究人员和社区提供对深度神经网络的长尾视觉学习的更好理解。

• 我们提供了对高级长尾学习研究的深入回顾&＃xff0c;并通过一个新的相对准确性度量来评估它们在多大程度上处理长尾类别失衡&＃xff0c;以实证研究最先进的方法。

• 我们为未来的研究确定了四个潜在的方法创新方向以及八个新的深度长尾学习任务设置。

第二节介绍了问题的定义&＃xff0c;并介绍了广泛使用的数据集、度量和网络骨架。第3节全面回顾了先进的长尾学习方法&＃xff0c;第4节基于一个新的评价指标实证分析了几种最先进的方法。第5节给出了深度长尾学习的应用场景&＃xff0c;第6节给出了未来的研究方向。我们在第7节结束调研。

本文仅做学术分享&＃xff0c;如有侵权&＃xff0c;请联系删文。

重磅&＃xff01;计算机视觉工坊-学习交流群已成立

扫码添加小助手微信&＃xff0c;可申请加入3D视觉工坊-学术论文写作与投稿微信交流群&＃xff0c;旨在交流顶会、顶刊、SCI、EI等写作与投稿事宜。

同时也可申请加入我们的细分方向交流群&＃xff0c;目前主要有ORB-SLAM系列源码学习、3D视觉、CV&深度学习、SLAM、三维重建、点云后处理、自动驾驶、CV入门、三维测量、VR/AR、3D人脸识别、医疗影像、缺陷检测、行人重识别、目标跟踪、视觉产品落地、视觉竞赛、车牌识别、硬件选型、深度估计、学术交流、求职交流等微信群&＃xff0c;请扫描下面微信号加群&＃xff0c;备注&＃xff1a;”研究方向&＃43;学校/公司&＃43;昵称“&＃xff0c;例如&＃xff1a;”3D视觉 &＃43; 上海交大 &＃43; 静静“。请按照格式备注&＃xff0c;否则不予通过。添加成功后会根据研究方向邀请进去相关微信群。原创投稿也请联系。

▲长按加微信群或投稿

▲长按关注公众号

3D视觉从入门到精通知识星球&＃xff1a;针对3D视觉领域的视频课程&＃xff08;三维重建系列、三维点云系列、结构光系列、手眼标定、相机标定、激光/视觉SLAM、自动驾驶等&＃xff09;、知识点汇总、入门进阶学习路线、最新paper分享、疑问解答五个方面进行深耕&＃xff0c;更有各类大厂的算法工程人员进行技术指导。与此同时&＃xff0c;星球将联合知名企业发布3D视觉相关算法开发岗位以及项目对接信息&＃xff0c;打造成集技术与就业为一体的铁杆粉丝聚集区&＃xff0c;近4000星球成员为创造更好的AI世界共同进步&＃xff0c;知识星球入口&＃xff1a;

学习3D视觉核心技术&＃xff0c;扫描查看介绍&＃xff0c;3天内无条件退款

圈里有高质量教程资料、可答疑解惑、助你高效解决问题

觉得有用&＃xff0c;麻烦给个赞和在看~

推荐阅读

upload
Coursera ML 机器学习

2019独角兽企业重金招聘Python工程师标准线性回归算法计算过程CostFunction梯度下降算法多变量回归![选择特征](https:static.oschina.n ... [详细]

蜡笔小新 2024-12-22 16:09:09
upload
从零开始构建完整手机站：Vue CLI 3 实战指南（第一部分）

本系列教程将引导您使用 Vue CLI 3 构建一个功能齐全的移动应用。我们将深入探讨项目中涉及的每一个知识点，并确保这些内容与实际工作中的需求紧密结合。 ... [详细]

蜡笔小新 2024-12-26 13:30:37
正则
【度量学习】Siamese Network

基于2-channelnetwork的图片相似度判别一、相关理论本篇博文主要讲解2015年CVPR的一篇关于图像相似度计算的文章：《LearningtoCompar ... [详细]

蜡笔小新 2024-12-12 19:11:33
正则
吴恩达推出TensorFlow实践课程，Python基础即可入门，四个月掌握核心技能

量子位报道，deeplearning.ai最新发布了TensorFlow实践课程，适合希望使用TensorFlow开发AI应用的学习者。该课程涵盖机器学习模型构建、图像识别、自然语言处理及时间序列预测等多个方面。 ... [详细]

蜡笔小新 2024-12-08 17:26:10
正则
强人工智能时代，区块链的角色与前景

随着强人工智能的崛起，区块链技术在新的技术生态中扮演着怎样的角色？本文探讨了区块链与强人工智能之间的互补关系及其在未来技术发展中的重要性。 ... [详细]

蜡笔小新 2024-12-07 14:46:21
正则
图像标签与以图搜图技术的应用与实践

本文探讨了图像标签的多种分类场景及其在以图搜图技术中的应用，涵盖了从基础理论到实际项目实施的全面解析。 ... [详细]

蜡笔小新 2024-12-07 14:28:06
正则
TensorFlow 入门：MNIST 数据集实战

本文详细介绍了 TensorFlow 的入门实践，特别是使用 MNIST 数据集进行数字识别的项目。文章首先解析了项目文件结构，并解释了各部分的作用，随后逐步讲解了如何通过 TensorFlow 实现基本的神经网络模型。 ... [详细]

蜡笔小新 2024-12-05 13:06:15
正则
数据库内核开发入门 | 搭建研发环境的初步指南

本课程将带你从零开始，逐步掌握数据库内核开发的基础知识和实践技能，重点介绍如何搭建OceanBase的开发环境。 ... [详细]

蜡笔小新 2024-12-27 16:38:48
正则
深入解析 org.apache.xmlbeans.SchemaType.getBaseEnumType() 方法及其应用

本文详细介绍了 Java 中 org.apache.xmlbeans.SchemaType 类的 getBaseEnumType() 方法，提供了多个代码示例，并解释了其在不同场景下的使用方法。 ... [详细]

蜡笔小新 2024-12-26 11:46:55
正则
从零构建递归神经网络：仅用NumPy实现

尽管使用TensorFlow和PyTorch等成熟框架可以显著降低实现递归神经网络（RNN）的门槛，但对于初学者来说，理解其底层原理至关重要。本文将引导您使用NumPy从头构建一个用于自然语言处理（NLP）的RNN模型。 ... [详细]

蜡笔小新 2024-12-26 11:29:15
x86
Qt 5.15.2 在银河麒麟龙芯平台打包的实战经验

本文详细记录了在银河麒麟操作系统和龙芯架构上使用 Qt 5.15.2 进行项目打包时遇到的问题及解决方案，特别关注于 linuxdeployqt 工具的应用。 ... [详细]

蜡笔小新 2024-12-26 10:54:04
正则
机器学习核心概念与技术

本文系统梳理了机器学习的关键知识点，涵盖模型评估、正则化、线性模型、支持向量机、决策树及集成学习等内容，并深入探讨了各算法的原理和应用场景。 ... [详细]

蜡笔小新 2024-12-22 09:15:30
正则
深入浅出TensorFlow数据读写机制

本文详细介绍TensorFlow中的数据读写操作，包括TFRecord文件的创建与读取，以及数据集（dataset）的相关概念和使用方法。 ... [详细]

蜡笔小新 2024-12-19 16:23:17
rust
游戏开发中的人工智能复习指南

本文档旨在帮助开发者回顾游戏开发中的人工智能技术，涵盖移动算法、群聚行为、路径规划、脚本AI、有限状态机、模糊逻辑、规则式AI、概率论与贝叶斯技术、神经网络及遗传算法等内容。 ... [详细]

蜡笔小新 2024-12-16 10:01:32
正则
Python 编辑数学公式：比 Word 更高效、更简单

在Word中编辑复杂的数学公式常常让人感到头疼，尤其是处理偏微分方程（PDE）等高级数学内容时。然而，最近GitHub上的一个开源项目latexify_py展示了如何利用Python轻松生成LaTeX数学公式，极大地简化了这一过程。 ... [详细]

蜡笔小新 2024-12-04 15:37:28

asdvuj

这个家伙很懒，什么也没留下！

Tags | 热门标签

RankList | 热门文章