【问题标题】:DBF - encoding cp1250DBF - 编码 cp1250
【发布时间】:2015-07-07 13:48:52
【问题描述】:

我有用 cp1250 编码的 dbf 数据库,我正在使用以下代码读取这个数据库:

import csv
from dbfpy import dbf
import os
import sys

filename = sys.argv[1]
if filename.endswith('.dbf'):
    print "Converting %s to csv" % filename
    csv_fn = filename[:-4]+ ".csv"
    with open(csv_fn,'wb') as csvfile:
        in_db = dbf.Dbf(filename)
        out_csv = csv.writer(csvfile)
        names = []
        for field in in_db.header.fields:
            names.append(field.name)
        #out_csv.writerow(names)
        for rec in in_db:
            out_csv.writerow(rec.fieldData)
        in_db.close()
        print "Done..."
else:
  print "Filename does not end with .dbf"

问题是,最终的 csv 文件是错误的。该文件的编码是 ANSI,并且某些字符已损坏。我想问你,如果你能帮助我如何正确读取 dbf 文件。

编辑 1

我尝试了与https://pypi.python.org/pypi/simpledbf/0.2.4不同的代码,有一些错误。

来源 2:

from simpledbf import Dbf5
import os
import sys

dbf = Dbf5('test.dbf', codec='cp1250');
dbf.to_csv('junk.csv');

输出:

python program2.py
Traceback (most recent call last):
  File "program2.py", line 5, in <module>
    dbf = Dbf5('test.dbf', codec='cp1250');
  File "D:\ProgramFiles\Anaconda\lib\site-packages\simpledbf\simpledbf.py",      line 557, in __init__
    assert terminator == b'\r'

断言错误

我真的不知道如何解决这个问题。

【问题讨论】:

    标签: python database encoding anaconda dbf


    【解决方案1】:

    尝试使用my dbf library

    import dbf
    with dbf.Table('test.dbf') as table:
        dbf.export(table, 'junk.csv')
    

    【讨论】:

      【解决方案2】:

      我写了 simpledbf。导致您出现问题的那一行来自我在开发模块时所做的一些测试。首先,您可能想要更新您的安装,因为 0.2.6 是最新的。然后,您可以尝试从文件“D:\ProgramFiles\Anaconda\lib\site-packages\simpledbf\simpledbf.py”中删除该特定行 (#557)。如果这不起作用,您可以通过GitHub repo for simpledbf 联系我,或者您可以尝试 Ethan 对 dbf 模块的建议。

      【讨论】:

      • 它也可以。感谢您的回答。 :) 空字段出现错误。"ValueError: 列类型 "" 尚不支持。"
      【解决方案3】:

      您可以根据需要进行解码和编码。 dbfpy 假定字符串是 utf8 编码的,因此您可以解码,因为它不是那种编码,然后使用正确的编码再次编码。

      import csv
      from dbfpy import dbf
      import os
      import sys
      
      filename = sys.argv[1]
      if filename.endswith('.dbf'):
          print "Converting %s to csv" % filename
          csv_fn = filename[:-4]+ ".csv"
          with open(csv_fn,'wb') as csvfile:
              in_db = dbf.Dbf(filename)
              out_csv = csv.writer(csvfile)
              names = []
              for field in in_db.header.fields:
                  names.append(field.name)
              #out_csv.writerow(names)
              for rec in in_db:
                  row = [i.decode('utf8').encode('cp1250') if isinstance(i, str) else i for i in rec.fieldData]
                  out_csv.writerow(rec.fieldData)
              in_db.close()
              print "Done..."
      else:
        print "Filename does not end with .dbf"
      

      【讨论】:

        猜你喜欢
        • 1970-01-01
        • 2017-12-01
        • 2015-08-05
        • 2016-05-05
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 1970-01-01
        • 2017-06-27
        相关资源
        最近更新 更多