【发布时间】:2019-05-01 20:31:42
【问题描述】:
试图删除不再需要的数据列。
我已尝试使用 .drop,但它没有做任何我能说的事情。
df=df.groupby(df['Distributor'])['Tickets Sold'].sum()
df1=df[df.div(df.sum()).lt(0.01)]
df2=df.drop(df1.index)
yourdf=pd.concat([df2,pd.Series(df1.sum(),index=['Others'])])
yourdf = yourdf.sort_values(ascending=False)
print(yourdf)
yourdf2 = yourdf.drop(columns=['Tickets Sold'])
print(yourdf2)
而不是这个。
20th Century Fox 141367982
Focus Features 18799261
Lionsgate 75834308
Paramount Pictures 86302817
STX Entertainment 22606674
Sony Pictures 102746480
Universal 159556790
Walt Disney 315655340
Warner Bros. 216426845
Others 74618013
然后进入这个。
Walt Disney 315655340
Warner Bros. 216426845
Universal 159556790
20th Century Fox 141367982
Sony Pictures 102746480
Paramount Pictures 86302817
Lionsgate 75834308
Others 74618013
STX Entertainment 22606674
Focus Features 18799261
我需要这个。
Walt Disney
Warner Bros.
Universal
20th Century Fox
Sony Pictures
Paramount Pictures
Lionsgate
Others
STX Entertainment
Focus Features
【问题讨论】:
-
你的数据框只有两列吗?
-
数据框一共6列680行。
-
-
@BenPap 我将如何在上面的代码中使用它?
标签: python pandas csv data-analysis