【发布时间】:2020-03-13 09:09:01
【问题描述】:
我有一个看起来像这样的熊猫数据框:
A B C D
80.00 2020-03-07 19:36:50 testing approved
80.00 2020-03-07 19:46:50 testing approved
我已经成功地将这个 pandas 数据框写入数据库,如下所示:
conn = create_engine('postgresql://username:password@redshift-blablabla.eu-west-1.redshift.amazonaws.com:5439/database_name')
dataframe.to_sql('table_name', conn,index=False, if_exists='replace')
当我尝试将此表用作在 Superset 中可视化数据的源时,我注意到所有内容都存储为 varchar,我不能使用列 B 作为日期戳来序列化数据。
写入数据库时如何定义列类型?并且日期戳是否应该只有日期而没有小时才能作为日期戳有效?
感谢您的帮助。
【问题讨论】:
标签: python sql pandas amazon-redshift