我可能想在这里重新发明轮子,但努比有一个
fromfile()
可以读取-i imagine-csv文件的函数。
它看起来非常快,甚至比熊猫还快
read_csv()
,但我不清楚它是如何工作的。
下面是一些测试代码:
import pandas as pd
import numpy as np
# Create the file here, two columns, one million rows of random numbers.
filename = 'my_file.csv'
df = pd.DataFrame({'a':np.random.randint(100,10000,1000000), 'b':np.random.randint(100,10000,1000000)})
df.to_csv(filename, index = False)
# Now read the file into memory.
arr = np.fromfile(filename)
print len(arr)
我包括了
len()
最后要确保它不只是一行字。但奇怪的是,我的长度(将根据你的随机数代而变化)是1352244。嗯?
The docs
显示可选
sep
参数.但当它被使用时:
arr = np.fromfile(filename, sep = ',')
…长度是0?!
理想情况下,我可以从这个csv文件中加载一个2d数组,但是我可以从这个csv文件中选择一个数组。
我错过了什么?