12个常用的图像数据增强技术总结-人工智能-PHP中文网

首页

科技周边

人工智能

12个常用的图像数据增强技术总结

王林

Apr 11, 2023 pm 10:49 PM

机器学习深度学习数据集

机器学习或深度学习模型的训练的目标是成为“通用”模型。这就需要模型没有过度拟合训练数据集，或者换句话说，我们的模型对看不见的数据有很好的了解。数据增强也是避免过度拟合的众多方法之一。

扩展用于训练模型的数据量的过程称为数据增强。通过训练具有多种数据类型的模型，我们可以获得更“泛化”的模型。“多种数据类型”是什么意思呢？本片文章只讨论“图像”数据增强技术，只详细地介绍各种图片数据增强策略。我们还将使用 PyTorch 动手实践并实现图像数据或计算机视觉中主要使用的数据增强技术。

因为介绍的是数据增强技术。所以只使用一张图片就可以了，我们先看看可视话的代码

import PIL.Image as Image
 import torch
 from torchvision import transforms
 import matplotlib.pyplot as plt
 import numpy as np
 import warnings
 
 def imshow(img_path, transform):

Resize/Rescale

此函数用于将图像的高度和宽度调整为我们想要的特定大小。下面的代码演示了我们想要将图像从其原始大小调整为 224 x 224。

path = './kitten.jpeg'
 transform = transforms.Resize((224, 224))
 imshow(path, transform)

Cropping

该技术将要选择的图像的一部分应用于新图像。例如，使用 CenterCrop 来返回一个中心裁剪的图像。

transform = transforms.CenterCrop((224, 224))
 imshow(path, transform)

RandomResizedCrop

这种方法同时结合了裁剪和调整大小。

transform = transforms.RandomResizedCrop((100, 300))
 imshow(path, transform)

12个常用的图像数据增强技术总结

Flipping

水平或垂直翻转图像，下面代码将尝试应用水平翻转到我们的图像。

transform = transforms.RandomHorizontalFlip()
 imshow(path, transform)

12个常用的图像数据增强技术总结

Padding

填充包括在图像的所有边缘上按指定的数量填充。我们将每条边填充50像素。

transform = transforms.Pad((50,50,50,50))
 imshow(path, transform)

12个常用的图像数据增强技术总结

Rotation

对图像随机施加旋转角度。我们将这个角设为15度。

transform = transforms.RandomRotation(15)
 imshow(path, transform)

12个常用的图像数据增强技术总结

Random Affine

这种技术是一种保持中心不变的变换。这种技术有一些参数：

degrees：旋转角度
translate：水平和垂直转换
scale：缩放参数
share：图片裁剪参数
fillcolor：图像外部填充的颜色

transform = transforms.RandomAffine(1, translate=(0.5, 0.5), scale=(1, 1), shear=(1,1), fillcolor=(256,256,256))
 imshow(path, transform)

Gaussian Blur

图像将使用高斯模糊进行模糊处理。

transform = transforms.GaussianBlur(7, 3)
 imshow(path, transform)

12个常用的图像数据增强技术总结

Grayscale

将彩色图像转换为灰度。

transform = transforms.Grayscale(num_output_channels=3)
 imshow(path, transform)

颜色增强，也称为颜色抖动，是通过改变图像的像素值来修改图像的颜色属性的过程。下面的方法都是颜色相关的操作。

Brightness

改变图像的亮度当与原始图像对比时，生成的图像变暗或变亮。

transform = transforms.ColorJitter(brightness=2)
 imshow(path, transform)

Contrast

图像最暗和最亮部分之间的区别程度被称为对比度。图像的对比度也可以作为增强进行调整。

transform = transforms.ColorJitter(cnotallow=2)
 imshow(path, transform)

Saturation

图片中颜色的分离被定义为饱和度。

transform = transforms.ColorJitter(saturatinotallow=20)
 imshow(path, transform)

Hue

色调被定义为图片中颜色的深浅。

transform = transforms.ColorJitter(hue=2)
 imshow(path, transform)

总结

图像本身的变化将有助于模型对未见数据的泛化，从而不会对数据进行过拟合。以上整理的都是我们常见的数据增强技术，torchvision中还包含了很多方法，可以在他的文档中找到：https://pytorch.org/vision/stable/transforms.html

以上是12个常用的图像数据增强技术总结的详细内容。更多信息请关注PHP中文网其他相关文章！

声明

本文转载于：51CTO.COM。如有侵权，请联系admin@php.cn删除

人工智能（AI）、机器学习（ML）和深度学习（DL）：有什么区别？Apr 12, 2023 pm 01:25 PM

人工智能Artificial Intelligence（AI）、机器学习Machine Learning（ML）和深度学习Deep Learning（DL）通常可以互换使用。但是，它们并不完全相同。人工智能是最广泛的概念，它赋予机器模仿人类行为的能力。机器学习是将人工智能应用到系统或机器中，帮助其自我学习和不断改进。最后，深度学习使用复杂的算法和深度神经网络来重复训练特定的模型或模式。让我们看看每个术语的演变和历程，以更好地理解人工智能、机器学习和深度学习实际指的是什么。人工智能自过去 70 多

深度学习GPU选购指南：哪款显卡配得上我的炼丹炉？Apr 12, 2023 pm 04:31 PM

众所周知，在处理深度学习和神经网络任务时，最好使用GPU而不是CPU来处理，因为在神经网络方面，即使是一个比较低端的GPU，性能也会胜过CPU。深度学习是一个对计算有着大量需求的领域，从一定程度上来说，GPU的选择将从根本上决定深度学习的体验。但问题来了，如何选购合适的GPU也是件头疼烧脑的事。怎么避免踩雷，如何做出性价比高的选择？曾经拿到过斯坦福、UCL、CMU、NYU、UW 博士 offer、目前在华盛顿大学读博的知名评测博主Tim Dettmers就针对深度学习领域需要怎样的GPU，结合自

字节跳动模型大规模部署实战Apr 12, 2023 pm 08:31 PM

一. 背景介绍在字节跳动，基于深度学习的应用遍地开花，工程师关注模型效果的同时也需要关注线上服务一致性和性能，早期这通常需要算法专家和工程专家分工合作并紧密配合来完成，这种模式存在比较高的 diff 排查验证等成本。随着 PyTorch/TensorFlow 框架的流行，深度学习模型训练和在线推理完成了统一，开发者仅需要关注具体算法逻辑，调用框架的 Python API 完成训练验证过程即可，之后模型可以很方便的序列化导出，并由统一的高性能 C++ 引擎完成推理工作。提升了开发者训练到部署的体验

基于深度学习的Deepfake检测综述Apr 12, 2023 pm 06:04 PM

深度学习 (DL) 已成为计算机科学中最具影响力的领域之一，直接影响着当今人类生活和社会。与历史上所有其他技术创新一样，深度学习也被用于一些违法的行为。Deepfakes 就是这样一种深度学习应用，在过去的几年里已经进行了数百项研究，发明和优化各种使用 AI 的 Deepfake 检测，本文主要就是讨论如何对 Deepfake 进行检测。为了应对Deepfake，已经开发出了深度学习方法以及机器学习（非深度学习）方法来检测。深度学习模型需要考虑大量参数，因此需要大量数据来训练此类模型。这正是

聊聊实时通信中的AI降噪技术Apr 12, 2023 pm 01:07 PM

Part 01 概述在实时音视频通信场景，麦克风采集用户语音的同时会采集大量环境噪声，传统降噪算法仅对平稳噪声（如电扇风声、白噪声、电路底噪等）有一定效果，对非平稳的瞬态噪声（如餐厅嘈杂噪声、地铁环境噪声、家庭厨房噪声等）降噪效果较差，严重影响用户的通话体验。针对泛家庭、办公等复杂场景中的上百种非平稳噪声问题，融合通信系统部生态赋能团队自主研发基于GRU模型的AI音频降噪技术，并通过算法和工程优化，将降噪模型尺寸从2.4MB压缩至82KB，运行内存降低约65%；计算复杂度从约186Mflop

地址标准化服务AI深度学习模型推理优化实践Apr 11, 2023 pm 07:28 PM

导读深度学习已在面向自然语言处理等领域的实际业务场景中广泛落地，对它的推理性能优化成为了部署环节中重要的一环。推理性能的提升：一方面，可以充分发挥部署硬件的能力，降低用户响应时间，同时节省成本；另一方面，可以在保持响应时间不变的前提下，使用结构更为复杂的深度学习模型，进而提升业务精度指标。本文针对地址标准化服务中的深度学习模型开展了推理性能优化工作。通过高性能算子、量化、编译优化等优化手段，在精度指标不降低的前提下，AI模型的模型端到端推理速度最高可获得了4.11倍的提升。1. 模型推理性能优化

深度学习撞墙？LeCun与Marcus到底谁捅了马蜂窝Apr 09, 2023 am 09:41 AM

今天的主角，是一对AI界相爱相杀的老冤家：Yann LeCun和Gary Marcus在正式讲述这一次的「新仇」之前，我们先来回顾一下，两位大神的「旧恨」。LeCun与Marcus之争Facebook首席人工智能科学家和纽约大学教授，2018年图灵奖（Turing Award）得主杨立昆（Yann LeCun）在NOEMA杂志发表文章，回应此前Gary Marcus对AI与深度学习的评论。此前，Marcus在杂志Nautilus中发文，称深度学习已经「无法前进」Marcus此人，属于是看热闹的不

英伟达首席科学家：深度学习硬件的过去、现在和未来Apr 12, 2023 pm 03:07 PM

过去十年是深度学习的“黄金十年”，它彻底改变了人类的工作和娱乐方式，并且广泛应用到医疗、教育、产品设计等各行各业，而这一切离不开计算硬件的进步，特别是GPU的革新。深度学习技术的成功实现取决于三大要素：第一是算法。20世纪80年代甚至更早就提出了大多数深度学习算法如深度神经网络、卷积神经网络、反向传播算法和随机梯度下降等。第二是数据集。训练神经网络的数据集必须足够大，才能使神经网络的性能优于其他技术。直至21世纪初，诸如Pascal和ImageNet等大数据集才得以现世。第三是硬件。只有

See all articles