【pytorch学习】之线性神经网络-图像分类数据集

时间：2024-04-25 11:56:38浏览次数：22

标签：num torch 神经网络 pytorch train 图像线性 data mnist

图像分类数据集

MNIST数据集 (LeCun et al., 1998) 是图像分类中广泛使用的数据集之一，但作为基准数据集过于简单。我们将使用类似但更复杂的Fashion‐MNIST数据集 (Xiao et al., 2017)。

%matplotlib inline
import torch
import torchvision
from torch.utils import data
from torchvision import transforms
from d2l import torch as d2l
d2l.use_svg_display()

5.1 读取数据集

我们可以通过框架中的内置函数将Fashion‐MNIST数据集下载并读取到内存中。

# 通过ToTensor实例将图像数据从PIL类型变换成32位浮点数格式，
# 并除以255使得所有像素的数值均在0～1之间
trans = transforms.ToTensor()
mnist_train = torchvision.datasets.FashionMNIST(root="../data", train=True, transform=trans, download=True)
mnist_test = torchvision.datasets.FashionMNIST(root="../data", train=False, transform=trans, download=True)

Fashion‐MNIST由10个类别的图像组成，每个类别由训练数据集（train dataset）中的6000张图像和测试数据集（test dataset）中的1000张图像组成。因此，训练集和测试集分别包含60000和10000张图像。测试数据集不会用于训练，只用于评估模型性能。

len(mnist_train), len(mnist_test)

(60000, 10000)

每个输入图像的高度和宽度均为28像素。数据集由灰度图像组成，其通道数为1。为了简洁起见，高度$h$像素、宽度$w$像素图像的形状记为$h × w$或$（h,w）$。

mnist_train[0][0].shape

torch.Size([1, 28, 28])

Fashion‐MNIST中包含的10个类别，分别为t‐shirt（T恤）、trouser（裤子）、pullover（套衫）、dress（连衣裙）、coat（外套）、sandal（凉鞋）、shirt（衬衫）、sneaker（运动鞋）、bag（包）和ankle boot（短靴）。以下函数用于在数字标签索引及其文本名称之间进行转换。

def get_fashion_mnist_labels(labels): #@save
    """返回Fashion-MNIST数据集的文本标签"""
    text_labels = ['t-shirt', 'trouser', 'pullover', 'dress', 'coat','sandal', 'shirt', 'sneaker', 'bag', 'ankle boot']
    return [text_labels[int(i)] for i in labels]

我们现在可以创建一个函数来可视化这些样本。

def show_images(imgs, num_rows, num_cols, titles=None, scale=1.5): #@save
    """绘制图像列表"""
    figsize = (num_cols * scale, num_rows * scale)
    _, axes = d2l.plt.subplots(num_rows, num_cols, figsize=figsize)
    axes = axes.flatten()
    for i, (ax, img) in enumerate(zip(axes, imgs)):
        if torch.is_tensor(img):
            # 图片张量
            ax.imshow(img.numpy())
        else:
        # PIL图片
            ax.imshow(img)
        ax.axes.get_xaxis().set_visible(False)
        ax.axes.get_yaxis().set_visible(False)
        if titles:
            ax.set_title(titles[i])
    return axes

以下是训练数据集中前几个样本的图像及其相应的标签。

X, y = next(iter(data.DataLoader(mnist_train, batch_size=18)))
show_images(X.reshape(18, 28, 28), 2, 9, titles=get_fashion_mnist_labels(y));

5.2 读取小批量

为了使我们在读取训练集和测试集时更容易，我们使用内置的数据迭代器，而不是从零开始创建。回顾一下，在每次迭代中，数据加载器每次都会读取一小批量数据，大小为batch_size。通过内置数据迭代器，我们可以随机打乱了所有样本，从而无偏见地读取小批量。

batch_size = 256
def get_dataloader_workers(): #@save
    """使用4个进程来读取数据"""
    return 4
train_iter = data.DataLoader(mnist_train, batch_size, shuffle=True,
num_workers=get_dataloader_workers())

我们看一下读取训练数据所需的时间。

timer = d2l.Timer()
for X, y in train_iter:
    continue
f'{timer.stop():.2f} sec'

'7.48 sec'

5.3 整合所有组件

现在我们定义load_data_fashion_mnist函数，用于获取和读取Fashion‐MNIST数据集。这个函数返回训练集和验证集的数据迭代器。此外，这个函数还接受一个可选参数resize，用来将图像大小调整为另一种形状。

def load_data_fashion_mnist(batch_size, resize=None): #@save
    """下载Fashion-MNIST数据集，然后将其加载到内存中"""
    trans = [transforms.ToTensor()]
    if resize:
        trans.insert(0, transforms.Resize(resize))
    trans = transforms.Compose(trans)
    mnist_train = torchvision.datasets.FashionMNIST(root="../data", train=True, transform=trans, download=True)
    mnist_test = torchvision.datasets.FashionMNIST(root="../data", train=False, transform=trans, download=True)
    return (data.DataLoader(mnist_train, batch_size, shuffle=True,num_workers=get_dataloader_workers()),
            data.DataLoader(mnist_test, batch_size, shuffle=False,num_workers=get_dataloader_workers()))

下面，我们通过指定resize参数来测试load_data_fashion_mnist函数的图像大小调整功能。

train_iter, test_iter = load_data_fashion_mnist(32, resize=64)
for X, y in train_iter:
    print(X.shape, X.dtype, y.shape, y.dtype)
    break

torch.Size([32, 1, 64, 64]) torch.float32 torch.Size([32]) torch.int64

标签：num,torch,神经网络,pytorch,train,图像,线性,data,mnist
From： https://www.cnblogs.com/zx-demo/p/18157293

【pytorch学习】之线性神经网络-实现线性回归
线性回归的从零开始实现在了解线性回归的关键思想之后，我们可以开始通过代码来动手实现线性回归了。我们将从零开始实现整个方法，包括数据流水线、模型、损失函数和小批量随机梯度下降优化器。虽然现代的深度学习框架几乎可以自动化地进行所有这些工作，但从零开始实现可以确保我们......
【pytorch学习】之线性神经网络-线性回归
线性神经网络【摘要】在介绍深度神经网络之前，我们需要了解神经网络训练的基础知识。我们将介绍神经网络的整个训练过程，包括：定义简单的神经网络架构、数据处理、指定损失函数和如何训练模型。为了更容易学习，我们将从经典算法————线性神经网络开始，介绍神经网络的基础知识。经典......
【pytorch学习】之概率
6概率简单地说，机器学习就是做出预测。根据病人的临床病史，我们可能想预测他们在下一年心脏病发作的概率。在飞机喷气发动机的异常检测中，我们想要评估一组发动机读数为正常运行情况的概率有多大。在强化学习中，我们希望智能体（agent）能在一个环境中智能地行动。这意味着我们需要考虑......
【pytorch学习】之微积分
4微积分在2500年前，古希腊人把一个多边形分成三角形，并把它们的面积相加，才找到计算多边形面积的方法。为了求出曲线形状（比如圆）的面积，古希腊人在这样的形状上刻内接多边形。如图所示，内接多边形的等长边越多，就越接近圆。这个过程也被称为逼近法（methodofexhaustion）事实上，逼近法就......
PyTorch中的优化器
SDG优化器参数说明：（引用：https://developer.baidu.com/article/detail.html?id=2705103）学习率（LearningRate）：学习率决定了模型权重更新的步长。较大的学习率可能导致模型训练不稳定，而较小的学习率可能导致训练速度缓慢。通常，你可以通过尝试不同的学习率来找到最佳值。默认情况下，学......
【rust】《Rust深度学习[4]-理解线性网络(Candle)》
全连接/线性在神经网络中，全连接层，也称为线性层，是一种层，其中来自一层的所有输入都连接到下一层的每个激活单元。在大多数流行的机器学习模型中，网络的最后几层是完全连接的。实际上，这种类型的层执行基于在先前层中学习的特征输出类别预测的任务。全连接层的示例，具有四个输入节点......
【rust】《Rust深度学习[5]-理解卷积神经网络(Candle)》
卷积神经网络ConvolutionalNeuralNetwork，简称为CNN。CNN与一般的顺传播型神经网络不同，它不仅是由全结合层，还由卷积层（ConvolutionLayer）和池层（PoolingLayer）构成的神经网络。在卷积层和池化层中，如下图所示，缩小输入神经元的一部分区域，局部地与下一层进行对应。每一层都有一个称......
【pytorch学习】之线性代数
3线性代数3.1标量如果你曾经在餐厅支付餐费，那么应该已经知道一些基本的线性代数，比如在数字间相加或相乘。例如，北京的温度为52◦F（华氏度，除摄氏度外的另一种温度计量单位）。严格来说，仅包含一个数值被称为标量（scalar）。如果要将此华氏度值转换为更常用的摄氏度，则可以计算表达式$C=......
【pytorch学习】之数据预处理
2数据预处理为了能用深度学习来解决现实世界的问题，我们经常从预处理原始数据开始，而不是从那些准备好的张量格式数据开始。在Python中常用的数据分析工具中，我们通常使用pandas软件包。像庞大的Python生态系统中的许多其他扩展包一样，pandas可以与张量兼容。2.1读取数据集举一个......
线性dp的反向思考
[ABC281D]MaxMultiple链接：https://www.luogu.com.cn/problem/AT_abc281_d题面翻译给定$n$个数。现在可以从中选$k$个数，需满足他们的和为$d$的倍数。求最大和值。translatedby@liangbowen。题目描述非負整数列$A=(a_1,a_2,\ldots,a_N)$が与えられます。......

【pytorch学习】之线性神经网络-图像分类数据集

图像分类数据集

5.1 读取数据集

5.2 读取小批量

5.3 整合所有组件

相关文章

赞助商

阅读排行