【发布时间】:2016-11-07 17:54:49
【问题描述】:
我的 pandas 数据框中有一个表格:
df = pd.DataFrame({
'CategoryCount': {0: 0, 1: 12, 2: 15, 3: 0, 4: 25, 5: 0},
'frequency': {0: 123, 1: 234, 2: 456, 3: 678, 4: 890, 5: 145}
})
+-----------------+-----------+
| CategoryCount | frequency |
+-----------------+-----------+
| 0 | 123 |
| 12 | 234 |
| 15 | 456 |
| 0 | 678 |
| 25 | 890 |
| 0 | 145 |
+-----------------+-----------+
它有 300 行
我想找到总数。 Categorycount 的,频率低于 75% 我正在用普通的 mysql 编写这个查询:
select count(CategoryCount)
from category_analysis
where (frequency * 100 / (select sum(frequency) from category_analysis)) < 75
我如何在 pandas 中使用 python 实现相同的功能。
【问题讨论】:
-
而且,预期的输出是?
-
@JohnGalt |count(CategoryCount) |213|是输出
-
IIUIC,
(df.frequency < df.frequency.sum() * 0.75 ).sum()应该可以工作。
标签: python python-2.7 python-3.x pandas dataframe