【发布时间】:2016-11-23 20:30:22
【问题描述】:
我想对 pandas 或 pyspark 数据帧中的连续列执行两种不同的计算。
列是周,指标显示为行。 我想计算各列之间的实际差异和百分比差异。
输入/输出表,包括。 Excel 中使用的计算显示在下图中。 我想在 pandas 或 pyspark 数据帧上复制这些计算。
附上原始数据:
Metrics Week20 Week21 Week22 Week23 Week24 Week25 Week26 Week27
Sales 20301 21132 20059 23062 19610 22734 22140 20699
TRXs 739 729 690 779 701 736 762 655
Attachment Rate 4.47 4.44 4.28 4.56 4.41 4.58 4.55 4.96
AOV 27.47 28.99 29.07 29.6 27.97 30.89 29.06 31.6
Profit 5177 5389 5115 5881 5001 5797 5646 5278
Profit per TRX 7.01 7.39 7.41 7.55 7.13 7.88 7.41 8.06
【问题讨论】:
-
理想情况下,您应该需要包含原始数据和代码而不是图像
标签: pandas pyspark multiple-columns difference