【发布时间】:2018-04-25 16:00:46
【问题描述】:
我正在使用 SQL Alchemy(通过 Flask_sqlalchemy)将 Python 字典列表插入 Postgres 数据库。
其中一个表是所有唯一项目的列表(表 1),而第二个表是与项目相关的时间序列数据(表 2)。
本质上,我想在表 1 中插入任何新行(具有唯一哈希),然后将其数据插入表 2。如果它已经存在于表 1 中,只需在表 2 中插入引用表 1 中的条目。
这是列表中的一项,列表中有几百个。
{'placement': '5662448s608653114', 't1': datetime.datetime(2018, 4, 15, 17, 47, 7, 434982), 't2': datetime.datetime(2018, 4, 25, 17, 47, 7, 434994), 'camp_id': 1, 'clicks': '0', 'visits': '3', 'conversions': '0', 'revenue': '0'}
我想将 5662448s608653114 插入 table1,然后将所有其他数据插入 table2,我在这里引用的项目不是 5662448s608653114,而是它的 id in表一
所以我会得到:
表 1:
____________________
1| 5662448s608653114
2| 5520103
表 2:
ID | Pl id | T1 | T2 | cost | revenue | clicks
_______________________________________________
499| 1 |
500| 2 |
我对此进行了测试,但它不起作用:
def write_tracker_data(self):
for item in self.data:
ts = Placements(placement_ts_hash=item["placement"])
pl = TrackerPlacementData(placement_id=ts.id, t1=item["t1"], t2=item["t2"], camp_id=1, revenue=item["revenue"], clicks=item["clicks"], conversions=item["conversions"])
db.session.add(pl)
db.session.commit()
上面的代码插入了数据,但是用none代替了表1中的id。它看起来也不是很高效,你知道什么时候做某事的感觉肯定可以做得更好……
以下是模型类供参考:
class Placements(db.Model):
id = db.Column(db.Integer, primary_key=True)
traffic_source = db.Column(db.Integer, db.ForeignKey('ts_types.id'))
placement_ts_hash = db.Column(db.String, index=True)
placement_url = db.Column(db.String)
placement_type = db.Column(db.String)
# Relationship betwwen unique placement table and tracker_placeemnt_data
tracker_data = db.relationship("TrackerPlacementData", backref="placement_hash")
class TrackerPlacementData(db.Model):
id = db.Column(db.Integer, primary_key=True)
t1 = db.Column(db.DateTime(timezone=True))
t2 = db.Column(db.DateTime(timezone=True), index=True)
camp_id = db.Column(db.Integer, db.ForeignKey('campaigns.id'), nullable=False)
placement_id = db.Column(db.Integer, db.ForeignKey('placements.id'), nullable=True, index=True)
revenue = db.Column(db.Float)
clicks = db.Column(db.Integer)
conversions = db.Column(db.Integer)
提前致谢。
编辑:这工作,但它似乎不是很好,因为循环中的每个项目都有一个新会话:/
def write_tracker_data(self):
for item in self.data:
ts = Placements(placement_ts_hash=item["placement"])
db.session.add(ts)
db.session.commit()
pl = TrackerPlacementData(placement_hash=ts, t1=item["t1"], t2=item["t2"], camp_id=1,
revenue=item["revenue"], clicks=item["clicks"], conversions=item["conversions"])
db.session.add(pl)
db.session.commit()
【问题讨论】:
-
也许
flush()是你需要的,stackoverflow.com/a/620831/5781248
标签: sqlalchemy flask-sqlalchemy python-3.5