【发布时间】:2019-06-27 20:45:56
【问题描述】:
我有两个 excel 文件中的数据,如下所示
已创建示例 DS:
df1 = {'Transaction_Name':['SC-001_Homepage', 'SC-002_Homepage', 'SC-001_Signinlink'], 'Count': [1, 1, 2]}
df1 = pd.DataFrame(df1, columns=df1.keys())
df2 = {'Transaction_Name':['SC-001_Homepage', 'SC-002_Homepage', 'SC-001_Signinlink'], 'Count': [2, 1, 2]}
df2 = pd.DataFrame(df2, columns=df2.keys())
请帮助我了解这两个 excel 的不同之处,如下所示。
Transaction_name Count_df1 Count_df2
SC-001_Homepage 1 2
SC-001_Homepage 1 1
SC-001_Homepage 2 2
输出计数的第一行不匹配。我可以用不同的颜色突出显示吗?示例代码如下
#COmparing both excels
df1 = pd.read_csv(r"WLMOUTPUT.csv", dtype=object)
df2 = pd.read_csv(r"results.csv", dtype=object)
print('\n', df1)
print('\n',df2)
df1['Compare'] = df1['Transaction_Name'] + df1['Count'].astype(str)
df2['Compare'] = df2['Transaction_Name'] + df2['Count'].astype(str)
print('\n', df1.loc[~df1['Compare'].isin(df2['Compare'])])
提前致谢
【问题讨论】:
-
你必须展示你迄今为止所做的工作的例子。
-
请找到我迄今为止为实现结果所做的工作#Formatting WLM data data = pd.read_excel(r"Script wise coordinates comparison_edited123.xlsx", sheet_name='WLM', dtype=object ) data = pd.DataFrame(data, columns=data.keys()) df = pd.melt(data, id_vars=['Script_name'], value_name='Count') df['Transaction_Name'] = df['Script_name '] + '_' + df['variable'] Final_df = df[['Transaction_Name', 'Count']] Final_df.to_csv(r'WLMOUTPUT.csv', index=False) 代码在下一条评论中继续进行比较两个 CSV 文件
-
你必须在你的问题中提供它,你可以编辑它以相应地调整它,你还需要格式化你的文本
-
@SwethaGorantla 没有人回答的原因是这里的信息太多。我建议您只发布 5-6 行示例数据,以数据框格式描述您尝试实现的目标,以便我们可以复制数据并复制问题以及 2 行解释,您的示例代码(不是完整的,仅有用的位)和预期的输出,仅此而已。 :) 检查this
-
按说明编辑问题,请检查一次。