【发布时间】:2019-08-31 14:48:45
【问题描述】:
我已经下载了一个关于国际足球比赛结果的数据集,但在可视化一件事时遇到了问题。列名如下:
日期
主队
客队
home_score
away_score
比赛
城市(比赛发生的地方)
国家(比赛发生地)
中立(如果比赛发生在主队国家之外,则为 TRUE,否则为 FALSE。)
我试图找出得分与比赛发生时间之间的相关性。为此,我想打印(然后计算)所有行,其中:
- home_team == city 和 home_score > away_score
- away_team == city 和 away_score > home_score
另外,如果你们知道如何在不创建两个单独条件的情况下将其结合起来,那也很高兴知道!
如果有人有兴趣,可以在这里获得数据集:https://www.kaggle.com/martj42/international-football-results-from-1872-to-2017
我尝试了以下方法,但没有成功
for row in df:
if df['home_team'] == df['city'] and home_score > away_score:
print (row)
这是我的代码:
df = pd.read_csv('results.csv')
由于某种原因,True/False 是布尔值,所以我将其更改为 str
booleandf = df.select_dtypes(include=[bool])
df_str = {True: 'TRUE', False: 'FALSE'}
for column in booleandf:
df['neutral'] = df['neutral'].map(df_str)
打印所有中性 == 'FALSE 的行
df[df['neutral'].str.contains("FALSE")]
遇到错误:解析时出现意外 EOF
【问题讨论】: