【发布时间】:2017-11-03 21:54:11
【问题描述】:
我是第一次尝试熊猫。我有一个包含两列的数据框:user_id 和 string。每个 user_id 可能有多个字符串,因此会在数据框中多次显示。我想从中得出另一个数据框;仅列出至少有 2 个或更多 strings 关联的 user_ids。
我尝试了df[df['user_id'].value_counts()> 1],我认为这是执行此操作的标准方法,但它产生了IndexingError: Unalignable boolean Series key provided。有人可以清除我的概念并提供正确的替代方案吗?
【问题讨论】: