numpy的学习笔记
一、numpy的基本操作
1. 引入依赖文件,并定义矩阵
import numpy as np
array = np.array([[1,2,3],
[2,3,4]])
print(array)
print("矩阵的维度:",array.ndim)
print("矩阵的形状:",array.shape)
print("矩阵元素个数:",array.size)
输出:
2. dtype 指定数据类型
a = np.array([2,23,4],dtype=np.int32)
print(a)
print(a.dtype)
输出:
3. 创建特定数据
a = np.zeros((3,4)) # 数据全为0,3行4列
b = np.ones((3,4),dtype = np.int) # 数据为1,3行4列,指定数据类型为int
c = np.empty((3,4)) # 数据为empty,3行4列,创建全空数组, 其实每个值都是接近于零的数:
输出:
4. 用 arange 创建连续数组
a = np.arange(10,20,2) # 10-19 的数据,2步长
print(a)
输出:
5. 使用 reshape 改变数据的形状
a = np.arange(12).reshape((3,4)) # 3行4列,0到11
print(a)
输出:
6. 用 linspace 创建线段型数据
a = np.linspace(1,10,6) # 开始端1,结束端10,且分割成6个数据,生成线段
b = np.linspace(1,10,6).reshape((2,3)) # 更改shape
print(a)
print(b)
输出:
二、numpy的基础运算1
1. 引入依赖文件,并定义矩阵
import numpy as np
a=np.array([10,20,30,40]) # array([10, 20, 30, 40])
b=np.arange(4) # array([0, 1, 2, 3])
2. 加减乘法
c=a-b # array([10, 19, 28, 37])
c=a+b # array([10, 21, 32, 43])
c=a*b # array([ 0, 20, 60, 120])
3. 乘方,求出矩阵中各个元素的乘方需要依赖双星符号 ** ,以二次方举例,即:
c=b**2 # array([0, 1, 4, 9])
4. Numpy中具有很多的数学函数工具,比如三角函数等(以sin函数为例)
c=10*np.sin(a)
# array([-5.44021111, 9.12945251, -9.88031624, 7.4511316 ])
5. 矩阵相乘
a=np.array([[1,1],[0,1]])
b=np.arange(4).reshape((2,2))
print(a)
# array([[1, 1],
# [0, 1]])
print(b)
# array([[0, 1],
# [2, 3]])
c_dot = np.dot(a,b)
# array([[2, 4],
# [2, 3]])
#另一种表达方式
c_dot_2 = a.dot(b)
# array([[2, 4],
# [2, 3]])
6. 关于 sum(), min(), max()的使用
import numpy as np
a=np.random.random((2,4))
print(a)
# array([[ 0.94692159, 0.20821798, 0.35339414, 0.2805278 ],
# [ 0.04836775, 0.04023552, 0.44091941, 0.21665268]])
np.sum(a) # 4.40436220
np.min(a) # 0.04023552
np.max(a) # 0.94692159
7. 在第6条基础上,如果你需要对行或者列进行查找运算,就需要在上述代码中为 axis 进行赋值。 当axis的值为0的时候,将会以列作为查找单元, 当axis的值为1的时候,将会以行作为查找单元。
print("a =",a)
# a = [[ 0.23651224 0.41900661 0.84869417 0.46456022]
# [ 0.60771087 0.9043845 0.36603285 0.55746074]]
print("sum =",np.sum(a,axis=1))
# sum = [ 1.96877324 2.43558896]
print("min =",np.min(a,axis=0))
# min = [ 0.23651224 0.41900661 0.36603285 0.46456022]
print("max =",np.max(a,axis=1))
# max = [ 0.84869417 0.9043845 ]
三、numpy的基础运算2
1. argmin() 和 argmax() 两个函数分别对应着求矩阵中最小元素和最大元素的索引
import numpy as np
A = np.arange(2,14).reshape((3,4))
# array([[ 2, 3, 4, 5]
# [ 6, 7, 8, 9]
# [10,11,12,13]])
print(np.argmin(A)) # 0
print(np.argmax(A)) # 11
2. 计算均值
print(np.mean(A)) # 7.5
print(np.average(A)) # 7.5
3. 中位数
print(A.median()) # 7.5
4. 逐步累加和累差
print(np.cumsum(A))
print(np.diff(A)) #计算每一行中后一项与前一项之差
# [2 5 9 14 20 27 35 44 54 65 77 90]
# [[1 1 1]
# [1 1 1]
# [1 1 1]]
5. nonzero()函数:这个函数将所有非零元素的行与列坐标分割开,重构成两个分别关于行和列的矩阵。
print(np.nonzero(A))
# (array([0,0,0,0,1,1,1,1,2,2,2,2]),array([0,1,2,3,0,1,2,3,0,1,2,3]))
6. 行排序
import numpy as np
A = np.arange(14,2, -1).reshape((3,4))
# array([[14, 13, 12, 11],
# [10, 9, 8, 7],
# [ 6, 5, 4, 3]])
print(np.sort(A))
# array([[11,12,13,14]
# [ 7, 8, 9,10]
# [ 3, 4, 5, 6]])
7. 矩阵的转置有两种表示方法:
print(np.transpose(A))
print(A.T)
# array([[14,10, 6]
# [13, 9, 5]
# [12, 8, 4]
# [11, 7, 3]])
# array([[14,10, 6]
# [13, 9, 5]
# [12, 8, 4]
# [11, 7, 3]])
8. clip()函数
这个函数的格式是clip(Array,Array_min,Array_max),顾名思义,Array指的是将要被执行用的矩阵,而后面的最小值最大值则用于让函数判断矩阵中元素是否有比最小值小的或者比最大值大的元素,并将这些指定的元素转换为最小值或者最大值。
print(A)
# array([[14,13,12,11]
# [10, 9, 8, 7]
# [ 6, 5, 4, 3]])
print(np.clip(A,5,9))
# array([[ 9, 9, 9, 9]
# [ 9, 9, 8, 7]
# [ 6, 5, 5, 5]])
四、numpy索引
1. 一维索引
import numpy as np
A = np.arange(3,15) #一维矩阵
# array([3, 4, 5, 6, 7, 8, 9, 10, 11, 12, 13, 14])
print(A[3])
# 6
A = np.arange(3,15).reshape((3,4)) #二维矩阵
"""
array([[ 3, 4, 5, 6]
[ 7, 8, 9, 10]
[11, 12, 13, 14]])
"""
print(A[2])
# [11 12 13 14]
2. 二维索引
以上面矩阵为例:
print(A[1][1]) # 8
print(A[1, 1]) # 8
print(A[1, 1:3]) # [8 9]
逐行打印:
for row in A:
print(row)
"""
[ 3, 4, 5, 6]
[ 7, 8, 9, 10]
[11, 12, 13, 14]
"""
逐列打印:
for column in A.T:
print(column)
"""
[ 3, 7, 11]
[ 4, 8, 12]
[ 5, 9, 13]
[ 6, 10, 14]
"""
下面的flatten是一个展开性质的函数,将多维的矩阵进行展开成1行的数列。而flat是一个迭代器,本身是一个object属性。
import numpy as np
A = np.arange(3,15).reshape((3,4))
print(A.flatten())
# array([3, 4, 5, 6, 7, 8, 9, 10, 11, 12, 13, 14])
for item in A.flat:
print(item)
# 3
# 4
……
# 14
五、Numpy array 合并
1. np.vstack()实现上下合并
对于一个array的合并,我们可以想到按行、按列等多种方式进行合并。
import numpy as np
A = np.array([1,1,1])
B = np.array([2,2,2])
print(np.vstack((A,B))) # vertical stack
"""
[[1,1,1]
[2,2,2]]
"""
2. np.hstack()实现左右合并
D = np.hstack((A,B)) # horizontal stack
print(D)
# [1,1,1,2,2,2]
print(A.shape,D.shape)
# (3,) (6,)
3. np.newaxis()实现转置的功能
前面所述的A序列, 转置操作便很有可能无法对其进行转置(因为A并不是矩阵的属性),此时就需要我们借助其他的函数操作进行转置:
print(A.T)
#[1 1 1]
print(A[np.newaxis,:])
# [[1 1 1]]
print(A[:,np.newaxis]) #转置
"""
[[1]
[1]
[1]]
"""
4. np.concatenate()实现多个矩阵或序列的合并操作
C = np.concatenate((A,B,B,A),axis=0)
print(C)
"""
array([[1],
[1],
[1],
[2],
[2],
[2],
[2],
[2],
[2],
[1],
[1],
[1]])
"""
D = np.concatenate((A,B,B,A),axis=1)
print(D)
"""
array([[1, 2, 2, 1],
[1, 2, 2, 1],
[1, 2, 2, 1]])
"""
六、Numpy array 分割
建立3行4列的Array
A = np.arange(12).reshape((3, 4))
print(A)
“”"
array([[ 0, 1, 2, 3],
[ 4, 5, 6, 7],
[ 8, 9, 10, 11]])
“”"
1. 纵向分割
print(np.split(A, 2, axis=1))
"""
[array([[0, 1],
[4, 5],
[8, 9]]), array([[ 2, 3],
[ 6, 7],
[10, 11]])]
"""
2. 横向分割
print(np.split(A, 3, axis=0))
# [array([[0, 1, 2, 3]]), array([[4, 5, 6, 7]]), array([[ 8, 9, 10, 11]])]
3. 错误的分割
范例的Array只有4列,只能等量对分,因此输入以上程序代码后Python就会报错。
print(np.split(A, 3, axis=1))
ValueError: array split does not result in an equal division
4. 不等量的分割
为了解决 3 中的情况, 我们会有下面这种方式——np.array_split().
print(np.array_split(A, 3, axis=1))
"""
[array([[0, 1],
[4, 5],
[8, 9]]), array([[ 2],
[ 6],
[10]]), array([[ 3],
[ 7],
[11]])]
"""
5. 其他的分割方式
在Numpy里还有np.vsplit()与横np.hsplit()方式可用
print(np.vsplit(A, 3)) #等于 print(np.split(A, 3, axis=0))
# [array([[0, 1, 2, 3]]), array([[4, 5, 6, 7]]), array([[ 8, 9, 10, 11]])]
print(np.hsplit(A, 2)) #等于 print(np.split(A, 2, axis=1))
"""
[array([[0, 1],
[4, 5],
[8, 9]]), array([[ 2, 3],
[ 6, 7],
[10, 11]])]
"""
七、Numpy copy & deep copy
引言: = 的赋值方式会带有关联性
import numpy as np a = np.arange(4)
array([0, 1, 2, 3])
b = a
c = a
d = b
按上述这么赋值的话,改变a的第一个值,b、c、d的第一个值也会同时改变。
a[0] = 11
print(a)
# array([11, 1, 2, 3])
确认b、c、d是否与a相同。
b is a # True
c is a # True
d is a # True
同样更改d的值,a、b、c也会改变。
d[1:3] = [22, 33] # array([11, 22, 33, 3])
print(a) # array([11, 22, 33, 3])
print(b) # array([11, 22, 33, 3])
print(c) # array([11, 22, 33, 3])
为了避免上述情况,我们使用copy() 的赋值方式没有关联性