【发布时间】:2012-07-30 13:59:08
【问题描述】:
我正在使用read_csv 将 CSV 文件读入 Pandas 数据帧。我的 CSV 文件包含大量小数/浮点数。这些数字使用欧洲十进制表示法编码:
1.234.456,78
这意味着'.'用作千位分隔符,',' 是小数点。
熊猫 0.8。提供了一个名为“千”的read_csv 参数来设置千位分隔符。还有一个额外的论点来提供小数点吗?如果不是,解析欧式十进制数最有效的方法是什么?
目前我正在使用字符串替换,我认为这会显着降低性能。我使用的编码是这样的:
# Convert to float data type and change decimal point from ',' to '.'
f = lambda x: string.replace(x, u',', u'.')
df['MyColumn'] = df['MyColumn'].map(f)
感谢任何帮助。
【问题讨论】:
-
请注意,GitHub 上的未解决问题 584 和 781 中提到了这一点