【发布时间】:2019-09-08 17:36:39
【问题描述】:
我的第一个数据框是:
df1 =
A B
61880 7
62646 8
62651 9
62656 10
62783 11
我的第二个数据框是:
df2 =
C D
62783 2
62646 3
61880 4
62656 5
62651 6
正如您在第一个和第二个数据框中看到的那样,我们有具有相同值的列,但顺序不同(!)(col A and col C)
期望的输出是: 从具有相同“A”和“C”值的行中取出“B”和“D”的所有值,并对它们进行数学运算(例如,B 除以 D)。
示例: 2 + 11(它们在“A”和“C”列中的值都相同,均为 62783)
添加!已编辑!
非常感谢!我遇到了另一个我忘记提及的问题:
有时,在“A”列中我有相同的值,例如我们可以看到“61880”两次,依此类推:
df1 =
A B
*61880* 7
**62646** 8
62651 9
62656 10
62783 11
*61880* 3
**62646** 2
我想通过考虑以下因素来执行您提到的相同过程:
我想根据“B”的值对“A”列进行排序,即“B”的总和。比如:
61880 7+3
62646 8+2
...
我用data.groupby('mm_fid')['vel'].sum() 做了,我得到了结果,但之后我不能做操作。因此,我想创建具有“B”总和的唯一列,然后继续您提供的答案!
【问题讨论】: