【发布时间】:2011-06-25 12:37:57
【问题描述】:
我正在进行一个项目,该项目涉及尝试从价值 70GB 的 xml 文档中获取大量信息并将其加载到关系数据库(在本例中为 postgres)我目前正在使用 python 脚本和 psycopg2 来执行此操作插入和诸如此类。我发现随着某些表中的行数增加。 (其中最大的行数约为 500 万行)脚本(插入)的速度已经慢到爬行。以前需要几分钟的事情现在需要大约一个小时。
我能做些什么来加快这个速度?我在这个任务中使用 python 和 psycopg2 有错吗?我可以对数据库做些什么来加快这个过程。我觉得我正在以完全错误的方式处理这件事。
【问题讨论】:
标签: python database-design postgresql psycopg2