【发布时间】:2020-02-06 22:23:46
【问题描述】:
我有一个具有以下 dtype 的数据框:
[2020-02-06 19:15:06,579] {logging_mixin.py:95} INFO -
campanha object
chave_sistema_origem int64
valor_ajustado object
当我尝试使用df.to_parquet(buffer, index=False) 编写镶木地板文件时,valor_ajustado 列的某些值会引发异常
[2020-02-06 19:15:06,597] {taskinstance.py:1047} ERROR - an integer is required (got type str)
...
File "/Users/jackhammer/.virtualenvs/python373/lib/python3.7/site-packages/pyarrow/pandas_compat.py", line 540, in convert_column
result = pa.array(col, type=type_, from_pandas=True, safe=safe)
File "pyarrow/array.pxi", line 207, in pyarrow.lib.array
File "pyarrow/array.pxi", line 78, in pyarrow.lib._ndarray_to_array
我知道valor_ajustado 列的值如下:
0
123,48
1
493,987
任何人都知道为什么它试图操纵整数而不是将列保留为对象?
【问题讨论】:
-
valor_ajustado列中的元素是什么类型?它们都是同一类型吗? -
您可以使用 .astype('str') 来显式使用字符串作为数据类型。