【发布时间】:2022-01-07 06:40:30
【问题描述】:
我有以下问题。我有一个 Python 数据库,其中包含根据原籍国(前两列)的酒店客户:
Hotel name Country Count
0 Hotel A US 2
1 Hotel A UK 1
2 Hotel A US 2
3 Hotel B UK 2
4 Hotel B UK 2
这意味着,在酒店 A 中,有 2 个客户来自美国,1 个来自英国;在酒店 B,他们有 2 个来自英国的客户,没有来自美国的客户。 我想要的是第三列,这意味着酒店拥有的按原产国观察的数量。到目前为止,我设法做到这一点的唯一方法是使用 for 循环,但由于我有 1000 万次观察,我想知道是否有更有效/更快的方法。
【问题讨论】:
-
你能提供预期的输出吗?
-
预期输出是第 3 列,df['count']。