【发布时间】:2018-11-26 02:55:29
【问题描述】:
我有一个包含 2 列的数据库。
import pandas as pd
data = pd.DataFrame({'a':[1,2,1,4,1,1,3,1,4,1,1,1],'b':[5,2,8,3,10,3,5,15,45,41,23,9]})
a b
0 1 5
1 2 2
2 1 8
3 4 3
4 1 10
5 1 3
6 3 5
7 1 15
8 4 45
9 1 41
10 1 23
11 1 9
每当自上次出现以来的累积值超过列 a 的给定阈值时,是否有一种 Pythonic/最快的方法来挑选行索引?例如,在上面的 df 中,如果我的阈值是 5,我会得到索引 3,6,8。
我目前的做法是遍历每一行,然后跟踪值何时超过它。我还不够 Python 专家想出一个潜在的(如果存在的话)更好的方法..
谢谢
【问题讨论】: