深度学习中的图像分割：方法和应用

时间：2021-01-07 10:28:02 来源：作者：

作者：missinglink.ai

编译：ronghuaiyang

导读

介绍使图像分割的方法，包括传统方法和深度学习方法，以及应用场景。

基于人工智能和深度学习方法的现代计算机视觉技术在过去10年里取得了显著进展。如今，它被用于图像分类、人脸识别、图像中物体的识别、视频分析和分类以及机器人和自动驾驶车辆的图像处理等应用上。

许多计算机视觉任务需要对图像进行智能分割，以理解图像中的内容，并使每个部分的分析更加容易。今天的图像分割技术使用计算机视觉深度学习模型来理解图像的每个像素所代表的真实物体，这在十年前是无法想象的。

深度学习可以学习视觉输入的模式，以预测组成图像的对象类。用于图像处理的主要深度学习架构是卷积神经网络(CNN)，或者是特定的CNN框架，如AlexNet、VGG、Inception和ResNet。计算机视觉的深度学习模型通常在专门的图形处理单元(GPU)上训练和执行，以减少计算时间。

什么是图像分割？

图像分割是计算机视觉中的一个关键过程。它包括将视觉输入分割成片段以简化图像分析。片段表示目标或目标的一部分，并由像素集或“超像素”组成。图像分割将像素组织成更大的部分，消除了将单个像素作为观察单位的需要。图像分析有三个层次：

分类 - 将整幅图片分成“人”、“动物”、“户外”等类别
目标检测 - 检测图像中的目标并在其周围画一个矩形，例如一个人或一只羊。
分割 - 识别图像的部分，并理解它们属于什么对象。分割是进行目标检测和分类的基础。

语义分割 vs. 实例分割

在分割过程本身，有两个粒度级别：

语义分割 - 将图像中的所有像素划分为有意义的对象类。这些类是“语义上可解释的”，并对应于现实世界的类别。例如，你可以将与猫相关的所有像素分离出来，并将它们涂成绿色。这也被称为dense预测，因为它预测了每个像素的含义。

实例分割 - 标识图像中每个对象的每个实例。它与语义分割的不同之处在于它不是对每个像素进行分类。如果一幅图像中有三辆车，语义分割将所有的车分类为一个实例，而实例分割则识别每一辆车。

传统的图像分割方法

还有一些过去常用的图像分割技术，但效率不如深度学习技术，因为它们使用严格的算法，需要人工干预和专业知识。这些包括:

阈值 - 将图像分割为前景和背景。指定的阈值将像素分为两个级别之一，以隔离对象。阈值化将灰度图像转换为二值图像或将彩色图像的较亮和较暗像素进行区分。
K-means聚类 - 算法识别数据中的组，变量K表示组的数量。该算法根据特征相似性将每个数据点(或像素)分配到其中一组。聚类不是分析预定义的组，而是迭代地工作，从而有机地形成组。
基于直方图的图像分割 - 使用直方图根据“灰度”对像素进行分组。简单的图像由一个对象和一个背景组成。背景通常是一个灰度级，是较大的实体。因此，一个较大的峰值代表了直方图中的背景灰度。一个较小的峰值代表这个物体，这是另一个灰色级别。
边缘检测 - 识别亮度的急剧变化或不连续的地方。边缘检测通常包括将不连续点排列成曲线线段或边缘。例如，一块红色和一块蓝色之间的边界。

深度学习如何助力图像分割方法

现代图像分割技术以深度学习技术为动力。下面是几种用于分割的深度学习架构：

使用CNN进行图像分割，是将图像的patch作为输入输入给卷积神经网络，卷积神经网络对像素进行标记。CNN不能一次处理整个图像。它扫描图像，每次看一个由几个像素组成的小“滤镜”，直到它映射出整个图像。

传统的cnn网络具有全连接的层，不能处理不同的输入大小。FCNs使用卷积层来处理不同大小的输入，可以工作得更快。最终的输出层具有较大的感受野，对应于图像的高度和宽度，而通道的数量对应于类的数量。卷积层对每个像素进行分类，以确定图像的上下文，包括目标的位置。

集成学习 将两个或两个以上相关分析模型的结果合成为单个。集成学习可以提高预测精度，减少泛化误差。这样就可以对图像进行精确的分类和分割。通过集成学习尝试生成一组弱的基础学习器，对图像的部分进行分类，并组合它们的输出，而不是试图创建一个单一的最优学习者。

DeepLab 使用DeepLab的一个主要动机是在帮助控制信号抽取的同时执行图像分割 —— 减少样本的数量和网络必须处理的数据量。另一个动机是启用多尺度上下文特征学习 —— 从不同尺度的图像中聚合特征。DeepLab使用ImageNet预训练的ResNet进行特征提取。DeepLab使用空洞卷积而不是规则的卷积。每个卷积的不同扩张率使ResNet块能够捕获多尺度的上下文信息。DeepLab由三个部分组成：

Atrous convolutions — 使用一个因子，可以扩展或收缩卷积滤波器的视场。
ResNet — 微软的深度卷积网络(DCNN)。它提供了一个框架，可以在保持性能的同时训练数千个层。ResNet强大的表征能力促进了计算机视觉应用的发展，如物体检测和人脸识别。
Atrous spatial pyramid pooling (ASPP) — 提供多尺度信息。它使用一组具有不同扩展率的复杂函数来捕获大范围的上下文。ASPP还使用全局平均池(GAP)来合并图像级特征并添加全局上下文信息。

SegNet neural network 一种基于深度编码器和解码器的架构，也称为语义像素分割。它包括对输入图像进行低维编码，然后在解码器中利用方向不变性能力恢复图像。然后在解码器端生成一个分割图像。

图像分割的应用

图像分割有助于确定目标之间的关系，以及目标在图像中的上下文。应用包括人脸识别、车牌识别和卫星图像分析。例如，零售和时尚等行业在基于图像的搜索中使用了图像分割。自动驾驶汽车用它来了解周围的环境。

目标检测和人脸检测

这些应用包括识别数字图像中特定类的目标实例。语义对象可以分类成类，如人脸、汽车、建筑物或猫。

人脸检测 - 一种用于许多应用的目标检测，包括数字相机的生物识别和自动对焦功能。算法检测和验证面部特征的存在。例如，眼睛在灰度图像中显示为谷地。
医学影像 - 从医学影像中提取临床相关信息。例如，放射学家可以使用机器学习来增强分析，通过将图像分割成不同的器官、组织类型或疾病症状。这可以减少运行诊断测试所需的时间。
机器视觉 - 捕捉和处理图像，为设备提供操作指导的应用。这包括工业和非工业的应用。机器视觉系统使用专用摄像机中的数字传感器，使计算机硬件和软件能够测量、处理和分析图像。例如，检测系统为汽水瓶拍照，然后根据合格 - 不合格标准分析图像，以确定瓶子是否被正确地填充。

视频监控 — 视频跟踪和运动目标跟踪

这涉及到在视频中定位移动物体。其用途包括安全和监视、交通控制、人机交互和视频编辑。

自动驾驶 自动驾驶汽车必须能够感知和理解他们的环境，以便安全驾驶。相关类别的对象包括其他车辆、建筑物和行人。语义分割使自动驾驶汽车能够识别图像中的哪些区域可以安全驾驶。
虹膜识别 一种能识别复杂虹膜图案的生物特征识别技术。它使用自动模式识别来分析人眼的视频图像。
人脸识别 从视频中识别个体。这项技术将从输入图像中选择的面部特征与数据库中的人脸进行比较。

零售图像识别

这个应用让零售商了解货架上商品的布局。算法实时处理产品数据，检测货架上是否有商品。如果有产品缺货，他们可以找出原因，通知跟单员，并为供应链的相应部分推荐解决方案。

英文原文：https://missinglink.ai/guides/computer-vision/image-segmentation-deep-learning-methods-Applications/

Tags：深度学习点击:() 评论:()

声明：本站部分内容及图片来自互联网,转载是出于传递更多信息之目的,内容观点仅代表作者本人,如有任何标注错误或版权侵犯请与我们联系(Email:2595517585@qq.com)，我们将及时更正、删除，谢谢。

▌相关推荐

什么是深度学习？什么是类脑计算？

现如今，谈起人工智能我们都会想到的是“深度学习”（deep learning），无论是战胜李世石的AlphaGo，还是能够随意写出人类水平文章的GPT-3，它们的背后都依托的是这套算法。它具有很好...【详细内容】

2021-09-14　　Tags: 深度学习点击:(104)　　评论:(0)　　加入收藏

详解深度学习中的注意力机制（Attention）

0 前言大家好，欢迎来到“自由技艺”的知识小馆。今天我们来探讨下深度学习中的 Attention 机制，中文名为“注意力”。本文内容结构组织如下：1 为什么需要引入 Attention 机制？2...【详细内容】

2021-06-09　　Tags: 深度学习点击:(149)　　评论:(0)　　加入收藏

微信正在用的深度学习框架开源！支持稀疏张量，基于C++开发

微信正用着的深度学习框架，现在你也可以上手试一试了。就在最近，腾讯把这个名叫deepx_core的深度学习基础库正式对外开源。相比于PyTorch、TensorFlow等流行深度学习框架，这位选手不仅具有通用性，还针对高维稀疏数据...【详细内容】

2021-04-06　　Tags: 深度学习点击:(205)　　评论:(0)　　加入收藏

5分钟搭建强大又好用的深度学习环境

为深度学习项目建立一个良好的环境不是一件容易的任务。因为需要处理的事情太多了:库必须匹配特定的版本，整个环境需要可以复制到其他机器上，所有东西都需要能够机器中的所有...【详细内容】

2021-03-05　　Tags: 深度学习点击:(96)　　评论:(0)　　加入收藏

什么是深度学习？

深度学习是机器学习的一个子领域，它采用了一个特定的模型：一族通过某种方式连接起来的简单函数。由于这类模型的结构是受到人类大脑结构的启发而创造出来的...【详细内容】

2021-02-26　　Tags: 深度学习点击:(269)　　评论:(0)　　加入收藏

深度学习中的图像分割：方法和应用

基于人工智能和深度学习方法的现代计算机视觉技术在过去10年里取得了显著进展。如今，它被用于图像分类、人脸识别、图像中物体的识别、视频分析和分类以及机器人和自动驾驶车辆的图像处理等应用上。...【详细内容】

2021-01-07　　Tags: 深度学习点击:(87)　　评论:(0)　　加入收藏

什么是深度学习？为何需要深度学习？

什么是深度学习深度学习有如下一些众所周知且被广泛接受的定义。（1）深度学习是机器学习的子集。（2）深度学习使用级联的多层（非线性）处理单元，称为人工神经网络（ANN），以及受大脑结构和...【详细内容】

2020-12-07　　Tags: 深度学习点击:(184)　　评论:(0)　　加入收藏

用Windows电脑训练深度学习模型？超详细配置教程来了

本文将介绍在 Windows 计算机上配置深度学习环境的全过程，其中涉及安装所需的工具和驱动软件。出人意料的是，即便只是配置深度学习环境，任务也不轻松。你很有可能在这个过程中犯错。我个人已经很多次从头开始配置深度学...【详细内容】

2020-12-02　　Tags: 深度学习点击:(97)　　评论:(0)　　加入收藏

一代深度学习框架研究

一代深度学习框架研究于璠华为技术有限公司摘要：从人工智能的历史出发，简述深度学习发展历程以及目前的挑战，通过介绍新一代深度学习框架的特点，分析总体框架，阐述自动并行、自动...【详细内容】

2020-11-10　　Tags: 深度学习点击:(94)　　评论:(0)　　加入收藏

用 Java 训练深度学习模型，原来能这么简单

HelloGitHub 推出的《讲解开源项目》系列。这一期是由亚马逊工程师：Keerthan Vasist，为我们讲解 DJL（完全由 Java 构建的深度学习平台）系列的第 4 篇。...【详细内容】

2020-11-03　　Tags: 深度学习点击:(86)　　评论:(0)　　加入收藏

▌简易百科推荐

可解释的AI (XAI)：如何使用LIME 和 SHAP更好地解释模型的预测

作为数据科学家或机器学习从业者，将可解释性集成到机器学习模型中可以帮助决策者和其他利益相关者有更多的可见性并可以让他们理解模型输出决策的解释。在本文中，我将介绍两个...【详细内容】

2021-12-17　　deephub　　　　Tags:AI 　点击:(15)　　评论:(0)　　加入收藏

AI系统中（机器学习算法）导致偏差的原因总结

基于算法的业务或者说AI的应用在这几年发展得很快。但是，在实际应用的场景中，我们经常会遇到一些非常奇怪的偏差现象。例如，Facebook将黑人标记为灵长类动物、城市图像识别系统...【详细内容】

2021-11-08　　数据学习DataLearner　　　　Tags:机器学习　点击:(32)　　评论:(0)　　加入收藏

人工智能会超过人类吗？顶尖科学家：人工智能在常识判断方面具有局限

11月2日召开的世界顶尖科学家数字未来论坛上，2013年诺贝尔化学奖得主迈克尔·莱维特、2014年诺贝尔生理学或医学奖得主爱德华·莫索尔、2007年图灵奖得主约瑟夫·斯发斯基、1986年图灵奖得主约翰·霍普克罗夫特、2002...【详细内容】

2021-11-03　　张淑贤　　证券时报　　Tags:人工智能　点击:(39)　　评论:(0)　　加入收藏

火爆业界的边缘计算，到底是什么？

鉴于物联网设备广泛部署、5G快速无线技术闪亮登场，把计算、存储和分析放在靠近数据生成的地方来处理，让边缘计算有了用武之地。边缘计算正在改变全球数百万个设备处理和传输...【详细内容】

2021-10-26　　　　计算机世界　　Tags:边缘计算　点击:(45)　　评论:(0)　　加入收藏

这725个机器学习术语表，太全了

这是几位机器学习权威专家汇总的725个机器学习术语表，非常全面了，值得收藏！英文术语中文翻译 0-1 Loss Function 0-1损失函数 Accept-Reject Samplin...【详细内容】

2021-10-21　　Python部落　　　　Tags:机器学习　点击:(43)　　评论:(0)　　加入收藏

程序员10 个入门级的机器学习开源项目

要开始为开源项目做贡献，有一些先决条件：1. 学习一门编程语言：由于在开源贡献中你需要编写代码才能参与开发，你需要学习任意一门编程语言。根据项目的需要，在后期学习另一种语言...【详细内容】

2021-10-20　　TSINGSEE青犀视频　　　　Tags:机器学习　点击:(37)　　评论:(0)　　加入收藏

Logistic Regression：最基础的神经网络

SimpleAI.人工智能、机器学习、深度学习还是遥不可及？来这里看看吧~ 从基本的概念、原理、公式，到用生动形象的例子去理解，到动手做实验去感知，到著名案例的学习，到用所学来实现...【详细内容】

2021-10-19　　憨昊昊　　　　Tags:神经网络　点击:(47)　　评论:(0)　　加入收藏

直击痛点 NLP技术的价值和落地｜超级观点

语言是人类思维的基础，当计算机具备了处理自然语言的能力，才具有真正智能的想象。自然语言处理（Natural Language Processing, NLP）作为人工智能（Artificial Intelligence, AI）的核心技术之一，是用计算机来处理、理解以及运...【详细内容】

2021-10-11　　　　36氪　　Tags:NLP 　点击:(48)　　评论:(0)　　加入收藏

边缘计算是个啥？为什么说发展5G离不开它？

边缘计算是什么？近年来，物联网设备数量呈线性增长趋势。根据艾瑞测算， 2020年，中国物联网设备的数量达74亿，预计2025年突破150亿个。同时，设备本身也变得越来越智能化，AI与互联网在...【详细内容】

2021-09-22　　汉智兴科技　　　　Tags: 　点击:(54)　　评论:(0)　　加入收藏

学了这些基础算法，人工智能就算入门了

说起人工智能，大家总把它和科幻电影中的机器人联系起来，而实际上这些科幻场景与现如今的人工智能没什么太大关系。人工智能确实跟人类大脑很相似，但它们的显著差异在于人工智能...【详细内容】

2021-09-17　　异步社区　　　　Tags:人工智能　点击:(57)　　评论:(0)　　加入收藏

推荐资讯

远程软件发展迅猛，ToDe	倒计时！企业QQ即将下架
极简Windows11与iPhon	iPhone信号问题，花10元
惊人数据：App Store中4	个人所得税递延纳税报
非常实用的 Python 库	等离子电视技术先进，为