pytorch数据处理

目前pytorch已经成为深度学习重要的学习框架,现阶段在完成自然语言处理预训练模型任务,正在学习这方面的知识。
首先说明,tensor类型可以是list,NumPy ndarray,tuple,scalar 以及其他类型
我们可以使用arange创建一个行向量x。这个行向量包含从0开始的前12个整数,它们被默认创建为浮点数。张量中的每个值都称为张量的元素

x = torch.arange(12)

在这里插入图片描述
可以通过张量的shape属性来访问张量(沿每个轴的长度)的形状。

x.shape

在这里插入图片描述
要想改变一个张量的形状而不改变元素数量和元素值,可以调用reshape函数。

x.reshape([3,4])
x.reshape(3,4)

在这里插入图片描述
如果在知道宽度后,高度会被自动计算得出,不必我们自己做除法。我们可以通过-1来调用此自动计算出维度的功能即可以用x.reshape(-1,4)或x.reshape(3,-1)来取代x.reshape(3,4)。

有时,我们希望[使用全0、全1、其他常量,或者从特定分布中随机采样的数字]来初始化矩阵。我们可以创建一个形状为(2,3,4)的张量,其中所有元素都设置为0或者1

torch.ones(2,3,4)
torch.ones([2,3,4])
torch.ones((2,3,4))

在这里插入图片描述
可以创建一个形状为(3,4)的张量。其中的每个元素都从均值为0、标准差为1的标准正态分布中随机采样。
在这里插入图片描述
通过提供包含数值的Python列表(或嵌套列表),来为所需张量中的每个元素赋予确定值。
在这里插入图片描述
可以在同一形状的任意两个张量上调用按元素操作
在这里插入图片描述
可以把多个张量连结在一起,把它们端对端地叠起来形成一个更大的张量。dim=0按行拼,dim=1按列拼
在这里插入图片描述

对张量中的所有元素进行求和,会产生一个单元素张量。
在这里插入图片描述
即使形状不同,我们仍然可以通过调用广播机制来执行按元素操作,广播机制取每个维度的最大值作为最后维度,要求维度必须相同。
在这里插入图片描述
使用索引和切片:可以用[-1]选择最后一个元素,可以用[1:3]选择第二个和第三个元素
在这里插入图片描述
可以用[::2]每间隔一个元素选择一个元素,可以用[::3]每间隔两个元素选择一个元素
在这里插入图片描述
如果在后续计算中没有重复使用X,我们也可以使用X[:] = X + Y或X += Y来减少操作的内存开销。

处理缺失值:

典型的方法包括插值法和删除法,常用方法:对于inputs中缺少的数值,我们用同一列的均值替换“NaN”项。

inputs = inputs.fillna(inputs.mean())

对于inputs中的类别值或离散值,我们将“NaN”视为一个类别。由于“巷子类型”(“Alley”)列只接受两种类型的类别值“Pave”和“NaN”,pandas可以自动将此列转换为两列“Alley_Pave”和“Alley_nan”。巷子类型为“Pave”的行会将“Alley_Pave”的值设置为1,“Alley_nan”的值设置为0。缺少巷子类型的行会将“Alley_Pave”和“Alley_nan”分别设置为0和1。
在这里插入图片描述

  • 0
    点赞
  • 2
    收藏
    觉得还不错? 一键收藏
  • 0
    评论

“相关推荐”对你有帮助么?

  • 非常没帮助
  • 没帮助
  • 一般
  • 有帮助
  • 非常有帮助
提交
评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值