我与一些CSV文件时,用下面的代码:Python的CSV错误:行包含空字节
reader = csv.reader(open(filepath, "rU"))
try:
for row in reader:
print 'Row read successfully!', row
except csv.Error, e:
sys.exit('file %s, line %d: %s' % (filename, reader.line_num, e))
而且一个文件引发此错误:
file my.csv, line 1: line contains NULL byte
我能做?谷歌似乎暗示它可能是一个Excel文件,它被不当地保存为.csv。有什么办法可以解决Python中的这个问题吗?
== == UPDATE
继@ JohnMachin的评论下面,我想这些行添加到我的脚本:
print repr(open(filepath, 'rb').read(200)) # dump 1st 200 bytes of file
data = open(filepath, 'rb').read()
print data.find('\x00')
print data.count('\x00')
这是我得到的输出:
'\xd0\xcf\x11\xe0\xa1\xb1\x1a\xe1\x00\x00\x00\x00\x00\x00\x00\x00\ .... <snip>
8
13834
所以该文件确实包含NUL字节。
“od -c”表示第一行看起来像什么? – 2010-11-12 15:22:15
我应该运行什么查询,如cat my.csv | od -c |更多 ?我得到:0000000 D e p a r t m e n t F a m i l – AP257 2010-11-12 15:35:13
CSV是如何生成的?从excel中,你可以尝试一种方言。否则看看说:http://stackoverflow.com/questions/2753022/python-finding-unicode-ascii-problems – 2010-11-12 15:51:37