【发布时间】:2019-02-20 15:58:35
【问题描述】:
repeat = 50
samplesize = 14
samplesize_list = [2, 5, 7]
std_list = [10, 20, 30]
mean_list = [1000, 2000, 3000]
repeat_median = np.empty(repeat, dtype = float)
for j in range(len(samplesize_list)):
size = samplesize_list[j]
for z in range(len(std_list)):
std_list = std_list[z]
for m in range(len(mean_list)):
mean_list = mean_list[m]
for i in range(repeat):
sample_data = np.random.normal(mean_list, std_list, size)
repeat_median[i] = np.median(sample_data)
plt.subplot(len(samplesize_list), 1, j+1)
sns.distplot(repeat_median, color = 'blue')
plt.legend(loc = "upper right")
plt.show()
我的代码中的 for 循环有点问题。我正在尝试使用 50 个不同结果的重复随机抽样来找到样本中位数的样本分布。所以我应该只有一个图表来显示 14 个样本的样本中位数的分布(构成 14 个样本的 3 个不同的子组(2、5、7)每个都具有各自的均值和标准差的正态分布)。
例如:总体 2 的子组呈正态分布,标准差为 10,均值为 1000。总体 5 的子组呈正态分布,标准差为 20,均值为 2000,依此类推。在这种情况下如何将它们循环在一起?
【问题讨论】:
标签: python matplotlib plot statistics