Я работаю с некоторыми CSV файлами со следующим кодом:
reader = csv.reader(open(filepath, "rU"))
try:
for row in reader:
print 'Row read successfully!', row
except csv.Error, e:
sys.exit('file %s, line %d: %s' % (filename, reader.line_num, e))
И один файл бросает эту ошибку:
file my.csv, line 1: line contains NULL byte
Что я могу сделать? Google, похоже, предположил, что это файл Excel, который был сохранен как .csv неправильно. Есть ли способ обойти эту проблему в Python?
== UPDATE ==
Следуя комментарию @JohnMachin ниже, я попытался добавить эти строки в свой script:
print repr(open(filepath, 'rb').read(200)) # dump 1st 200 bytes of file
data = open(filepath, 'rb').read()
print data.find('\x00')
print data.count('\x00')
И это результат, который я получил:
'\xd0\xcf\x11\xe0\xa1\xb1\x1a\xe1\x00\x00\x00\x00\x00\x00\x00\x00\ .... <snip>
8
13834
Таким образом, файл действительно содержит NUL байты.