【发布时间】:2016-06-06 08:44:21
【问题描述】:
我正在计算一个 coskew 矩阵,并想用 skew 方法中内置的 pandas 仔细检查我的计算。我无法协调 pandas 执行计算的方式。
将我的系列定义为:
import pandas as pd
series = pd.Series(
{0: -0.051917457635120283,
1: -0.070071606515280632,
2: -0.11204865874074735,
3: -0.14679988245503134,
4: -0.088062467095565145,
5: 0.17579741198527793,
6: -0.10765856028420773,
7: -0.11971470229167547,
8: -0.15169210769159247,
9: -0.038616800990881606,
10: 0.16988162977411481,
11: 0.092999418364443032}
)
我比较了以下计算并期望它们是相同的。
熊猫
series.skew()
1.1119637586658944
我
(((series - series.mean()) / series.std(ddof=0)) ** 3).mean()
0.967840223081231
我 - 拿 2
这是明显不同的。我想可能是Fisher-Pearson coefficient。所以我做了:
n = len(series)
skew = series.sub(series.mean()).div(series.std(ddof=0)).apply(lambda x: x ** 3).mean()
skew * (n * (n - 1)) ** 0.5 / (n - 1)
1.0108761442417222
还差很多。
问题
pandas 如何计算 skew?
【问题讨论】: