Python Numpy中数据的常用保存与读取方法_F11 - 专业站长和开发者的学习网站

分享到

Python Numpy中数据的常用保存与读取方法

python 来源：互联网搜集作者：秩名发布时间：2020-04-01 23:14:54 人浏览

摘要

在经常性读取大量的数值文件时(比如深度学习训练数据),可以考虑现将数据存储为 Numpy 格式,然后直接使用Numpy去读取,速度相比为转化前快很多. 下面就常用的保存数据到二进制文件和保存数据到文本文件进行介绍: 1.保存为二进制文件(.npy/.npz) numpy.save 保

在经常性读取大量的数值文件时(比如深度学习训练数据),可以考虑现将数据存储为Numpy格式,然后直接使用Numpy去读取,速度相比为转化前快很多.

下面就常用的保存数据到二进制文件和保存数据到文本文件进行介绍:

1.保存为二进制文件(.npy/.npz)

numpy.save

保存一个数组到一个二进制的文件中,保存格式是.npy

参数介绍

numpy.save(file, arr, allow_pickle=True, fix_imports=True)
file:文件名/文件路径
arr:要存储的数组
allow_pickle:布尔值,允许使用Python pickles保存对象数组(可选参数,默认即可)
fix_imports:为了方便Pyhton2中读取Python3保存的数据(可选参数,默认即可)

使用

				?

									>>> import numpy as np 

									#生成数据 

									>>> x=np.arange(10) 

									>>> x 

									array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9]) 

									#数据保存 

									>>> np.save('save_x',x) 

									#读取保存的数据 

									>>> np.load('save_x.npy') 

									array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9]) 

									numpy.savez

这个同样是保存数组到一个二进制的文件中,但是厉害的是,它可以保存多个数组到同一个文件中,保存格式是.npz,它其实就是多个前面np.save的保存的npy,再通过打包(未压缩)的方式把这些文件归到一个文件上,不行你去解压npz文件就知道了,里面是就是自己保存的多个npy.

参数介绍

numpy.savez(file, *args, **kwds)
file:文件名/文件路径
*args:要存储的数组,可以写多个,如果没有给数组指定Key,Numpy将默认从'arr_0','arr_1'的方式命名
kwds:(可选参数,默认即可)

使用

				?

									>>> import numpy as np 

									#生成数据 

									>>> x=np.arange(10) 

									>>> x 

									array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9]) 

									>>> y=np.sin(x) 

									>>> y 

									array([ 0.  , 0.84147098, 0.90929743, 0.14112001, -0.7568025 , 

									  -0.95892427, -0.2794155 , 0.6569866 , 0.98935825, 0.41211849]) 

									#数据保存 

									>>> np.save('save_xy',x,y) 

									#读取保存的数据 

									>>> npzfile=np.load('save_xy.npz') 

									>>> npzfile #是一个对象,无法读取 

									<numpy.lib.npyio.NpzFile object at 0x7f63ce4c8860> 

									#按照组数默认的key进行访问 

									>>> npzfile['arr_0'] 

									array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9]) 

									>>> npzfile['arr_1'] 

									array([ 0.  , 0.84147098, 0.90929743, 0.14112001, -0.7568025 , 

									  -0.95892427, -0.2794155 , 0.6569866 , 0.98935825, 0.41211849])

更加神奇的是,你可以不适用Numpy默认给数组的Key,而是自己给数组有意义的Key,这样就可以不用去猜测自己加载数据是否是自己需要的.

				?

									#数据保存 

									>>> np.savez('newsave_xy',x=x,y=y) 

									#读取保存的数据 

									>>> npzfile=np.load('newsave_xy.npz') 

									#按照保存时设定组数key进行访问 

									>>> npzfile['x'] 

									array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9]) 

									>>> npzfile['y'] 

									array([ 0.  , 0.84147098, 0.90929743, 0.14112001, -0.7568025 , 

									  -0.95892427, -0.2794155 , 0.6569866 , 0.98935825, 0.41211849])

简直不能太爽,深度学习中,有时候你保存了训练集,验证集,测试集,还包括他们的标签,用这个方式存储起来,要啥加载啥,文件数量大大减少,也不会到处改文件名去.

numpy.savez_compressed

这个就是在前面numpy.savez的基础上加了压缩,前面我介绍时尤其注明numpy.savez是得到的文件打包,不压缩的.这个文件就是对文件进行打包时使用了压缩,可以理解为压缩前各npy的文件大小不变,使用该函数比前面的numpy.savez得到的npz文件更小.

注:函数所需参数和numpy.savez一致,用法完成一样.

2.保存到文本文件

numpy.savetxt

保存数组到文本文件上,可以直接打开查看文件里面的内容.

参数介绍

numpy.savetxt(fname, X, fmt='%.18e', delimiter=' ', newline='\n', header='', footer='', comments='# ', encoding=None)
fname:文件名/文件路径,如果文件后缀是.gz,文件将被自动保存为.gzip格式,np.loadtxt可以识别该格式
X:要存储的1D或2D数组
fmt:控制数据存储的格式
delimiter:数据列之间的分隔符
newline:数据行之间的分隔符
header:文件头步写入的字符串
footer:文件底部写入的字符串
comments:文件头部或者尾部字符串的开头字符,默认是'#'
encoding:使用默认参数

使用

				?

									>>> import numpy as np 

									#生成数据 

									>>> x = y = z = np.ones((2,3)) 

									>>> x 

									array([[1., 1., 1.], 

									  [1., 1., 1.]]) 

									#保存数据 

									np.savetxt('test.out', x) 

									np.savetxt('test1.out', x,fmt='%1.4e') 

									np.savetxt('test2.out', x, delimiter=',') 

									np.savetxt('test3.out', x,newline='a') 

									np.savetxt('test4.out', x,delimiter=',',newline='a') 

									np.savetxt('test5.out', x,delimiter=',',header='abc') 

									np.savetxt('test6.out', x,delimiter=',',footer='abc')

保存下来的文件都是友好的,可以直接打开看看有什么变化.

numpy.loadtxt

根据前面定制的保存格式,相应的加载数据的函数也得变化.

参数介绍

numpy.loadtxt(fname, dtype=<class 'float'>, comments='#', delimiter=None, converters=None, skiprows=0, usecols=None, unpack=False, ndmin=0, encoding='bytes')
fname:文件名/文件路径,如果文件后缀是.gz或.bz2,文件将被解压,然后再载入
dtype:要读取的数据类型
comments:文件头部或者尾部字符串的开头字符,用于识别头部,尾部字符串
delimiter:划分读取上来值的字符串
converters:数据行之间的分隔符
.......后面不常用的就不写了

使用

			?

								np.loadtxt('test.out') 

								np.loadtxt('test2.out', delimiter=',')

您可能感兴趣的文章 :

原文链接 : https://www.cnblogs.com/djdjdj123/p/12215528.html

Tag : python(762)numpy(15)

Python Django教程之实现新闻应用程序

Django是一个用Python编写的高级框架，它允许我们创建服务器端Web应用程序。在本文中，我们将了解如何使用Django创建新闻应用程序。我们将
书写Python代码的一种更优雅方式(推荐!)

一些比较熟悉pandas的读者朋友应该经常会使用query()、eval()、pipe()、assign()等pandas的常用方法，书写可读性很高的「链式」数据分析处理代码
Python灰度变换中伽马变换分析实现

1. 介绍伽马变换主要目的是对比度拉伸，将图像灰度较低的部分进行修正伽马变换针对的是对单个像素点的变换，也就是点对点的映射形
使用OpenCV实现迷宫解密的全过程

一、你能自己走出迷宫吗？如下图所示，可以看到是一张较为复杂的迷宫图，相信也有人尝试过自己一点一点的找出口，但我们肉眼来解谜
Python中的数据精度问题的介绍

一、python运算时精度问题 1.运行时精度问题在Python中（其他语言中也存在这个问题，这是计算机采用二进制导致的），有时候由于二进制和
Python随机值生成的常用方法

一、随机整数 1.包含上下限：[a, b] 1 2 3 4 import random #1、随机整数：包含上下限：[a, b] for i in range(10): print(random.randint(0,5),end= | ) 查看运行结
Python字典高级用法深入分析讲解

一、 collections 中 defaultdict 的使用 1.字典的键映射多个值将下面的列表转成字典 l = [(a,2),(b,3),(a,1),(b,4),(a,3),(a,1),(b,3)] 一个字典就是一个键对
Python浅析多态与鸭子类型使用实例

什么多态：同一事物有多种形态为何要有多态=》多态会带来什么样的特性，多态性多态性指的是可以在不考虑对象具体类型的情况下而直
Python字典高级用法深入分析介绍

一、 collections 中 defaultdict 的使用 1.字典的键映射多个值将下面的列表转成字典 l = [(a,2),(b,3),(a,1),(b,4),(a,3),(a,1),(b,3)] 一个字典就是一个键对
Python淘宝或京东等秒杀抢购脚本实现(秒杀脚本

我们的目标是秒杀淘宝或京东等的订单，这里面有几个关键点，首先需要登录淘宝或京东，其次你需要准备好订单，最后要在指定时间快速