文章詳情頁

Python Numpy中數據的常用保存與讀取方法

瀏覽：6日期：2022-07-31 13:37:09

在經常性讀取大量的數值文件時(比如深度學習訓練數據),可以考慮現將數據存儲為Numpy格式,然后直接使用Numpy去讀取,速度相比為轉化前快很多.

下面就常用的保存數據到二進制文件和保存數據到文本文件進行介紹:

1.保存為二進制文件(.npy/.npz)

numpy.save

保存一個數組到一個二進制的文件中,保存格式是.npy

參數介紹

numpy.save(file, arr, allow_pickle=True, fix_imports=True)file:文件名/文件路徑arr:要存儲的數組allow_pickle:布爾值,允許使用Python pickles保存對象數組(可選參數,默認即可)fix_imports:為了方便Pyhton2中讀取Python3保存的數據(可選參數,默認即可)

使用

>>> import numpy as np #生成數據 >>> x=np.arange(10) >>> x array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9]) #數據保存 >>> np.save(’save_x’,x) #讀取保存的數據 >>> np.load(’save_x.npy’) array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9]) numpy.savez

這個同樣是保存數組到一個二進制的文件中,但是厲害的是,它可以保存多個數組到同一個文件中,保存格式是.npz,它其實就是多個前面np.save的保存的npy,再通過打包(未壓縮)的方式把這些文件歸到一個文件上,不行你去解壓npz文件就知道了,里面是就是自己保存的多個npy.

參數介紹

numpy.savez(file, *args, **kwds)file:文件名/文件路徑*args:要存儲的數組,可以寫多個,如果沒有給數組指定Key,Numpy將默認從’arr_0’,’arr_1’的方式命名kwds:(可選參數,默認即可)

使用

>>> import numpy as np #生成數據 >>> x=np.arange(10) >>> x array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9]) >>> y=np.sin(x) >>> y array([ 0. , 0.84147098, 0.90929743, 0.14112001, -0.7568025 , -0.95892427, -0.2794155 , 0.6569866 , 0.98935825, 0.41211849]) #數據保存 >>> np.save(’save_xy’,x,y) #讀取保存的數據 >>> npzfile=np.load(’save_xy.npz’) >>> npzfile #是一個對象,無法讀取 <numpy.lib.npyio.NpzFile object at 0x7f63ce4c8860> #按照組數默認的key進行訪問 >>> npzfile[’arr_0’] array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9]) >>> npzfile[’arr_1’] array([ 0. , 0.84147098, 0.90929743, 0.14112001, -0.7568025 , -0.95892427, -0.2794155 , 0.6569866 , 0.98935825, 0.41211849])

更加神奇的是,你可以不適用Numpy默認給數組的Key,而是自己給數組有意義的Key,這樣就可以不用去猜測自己加載數據是否是自己需要的.

#數據保存 >>> np.savez(’newsave_xy’,x=x,y=y) #讀取保存的數據 >>> npzfile=np.load(’newsave_xy.npz’) #按照保存時設定組數key進行訪問 >>> npzfile[’x’] array([0, 1, 2, 3, 4, 5, 6, 7, 8, 9]) >>> npzfile[’y’] array([ 0. , 0.84147098, 0.90929743, 0.14112001, -0.7568025 , -0.95892427, -0.2794155 , 0.6569866 , 0.98935825, 0.41211849])

簡直不能太爽,深度學習中,有時候你保存了訓練集,驗證集,測試集,還包括他們的標簽,用這個方式存儲起來,要啥加載啥,文件數量大大減少,也不會到處改文件名去.

numpy.savez_compressed

這個就是在前面numpy.savez的基礎上加了壓縮,前面我介紹時尤其注明numpy.savez是得到的文件打包,不壓縮的.這個文件就是對文件進行打包時使用了壓縮,可以理解為壓縮前各npy的文件大小不變,使用該函數比前面的numpy.savez得到的npz文件更小.

注:函數所需參數和numpy.savez一致,用法完成一樣.

2.保存到文本文件

numpy.savetxt

保存數組到文本文件上,可以直接打開查看文件里面的內容.

參數介紹

numpy.savetxt(fname, X, fmt=’%.18e’, delimiter=’ ’, newline=’n’, header=’’, footer=’’, comments=’# ’, encoding=None)fname:文件名/文件路徑,如果文件后綴是.gz,文件將被自動保存為.gzip格式,np.loadtxt可以識別該格式X:要存儲的1D或2D數組fmt:控制數據存儲的格式delimiter:數據列之間的分隔符newline:數據行之間的分隔符header:文件頭步寫入的字符串footer:文件底部寫入的字符串comments:文件頭部或者尾部字符串的開頭字符,默認是’#’encoding:使用默認參數

使用

>>> import numpy as np #生成數據 >>> x = y = z = np.ones((2,3)) >>> x array([[1., 1., 1.], [1., 1., 1.]]) #保存數據 np.savetxt(’test.out’, x) np.savetxt(’test1.out’, x,fmt=’%1.4e’) np.savetxt(’test2.out’, x, delimiter=’,’) np.savetxt(’test3.out’, x,newline=’a’) np.savetxt(’test4.out’, x,delimiter=’,’,newline=’a’) np.savetxt(’test5.out’, x,delimiter=’,’,header=’abc’) np.savetxt(’test6.out’, x,delimiter=’,’,footer=’abc’)

保存下來的文件都是友好的,可以直接打開看看有什么變化.

numpy.loadtxt

根據前面定制的保存格式,相應的加載數據的函數也得變化.

參數介紹

numpy.loadtxt(fname, dtype=<class ’float’>, comments=’#’, delimiter=None, converters=None, skiprows=0, usecols=None, unpack=False, ndmin=0, encoding=’bytes’)fname:文件名/文件路徑,如果文件后綴是.gz或.bz2,文件將被解壓,然后再載入dtype:要讀取的數據類型comments:文件頭部或者尾部字符串的開頭字符,用于識別頭部,尾部字符串delimiter:劃分讀取上來值的字符串converters:數據行之間的分隔符.......后面不常用的就不寫了

使用

np.loadtxt(’test.out’) np.loadtxt(’test2.out’, delimiter=’,’)

總結

到此這篇關于Python Numpy中數據的常用保存與讀取方法的文章就介紹到這了,更多相關python numpy 數據保存讀取內容請搜索好吧啦網以前的文章或繼續瀏覽下面的相關文章希望大家以后多多支持好吧啦網！

Python 編程

上一條：Python 線性回歸分析以及評價指標詳解下一條：Python PyQt5整理介紹

相關文章：

1. css代碼優化的12個技巧2. 告別AJAX實現無刷新提交表單3. asp批量添加修改刪除操作示例代碼4. ASP刪除img標簽的style屬性只保留src的正則函數5. CSS Hack大全-教你如何區分出IE6-IE10、FireFox、Chrome、Opera6. ASP中格式化時間短日期補0變兩位長日期的方法7. ASP實現加法驗證碼8. HTML DOM setInterval和clearInterval方法案例詳解9. 讀大數據量的XML文件的讀取問題10. ASP中if語句、select 、while循環的使用方法

排行榜

					
					Docker容器如何更新打包并上傳到阿里云
JetBrains IntelliJ IDEA 配置優化技巧
Django Model層F，Q對象和聚合函數原理解析
Django結合使用Scrapy爬取數據入庫的方法示例
JSP之表單提交get和post的區別詳解及實例
.NET 中配置從xml轉向json方法示例詳解
ASP刪除img標簽的style屬性只保留src的正則函數
告別AJAX實現無刷新提交表單
ASP實現加法驗證碼
PHP設計模式中工廠模式深入詳解
JavaScript實現組件化和模塊化方法詳解