【发布时间】:2019-07-10 09:47:51
【问题描述】:
我有一个超过 8000 列的 df。每列(除了第一列)代表二进制值 0 或 1。
|Name| t1| t2| t3|...| t4|
| ..aa.. | 0 | 0 | 1 |...| 0 |
| ..bb.. | 0 | 0 | 0 |...| 0 |
| ..cc.. | 1 | 0 | 0 |...| 0 |
我的目标是计算 aa,bb,cc 之间的 jaccard 索引,以便我需要存储在列表中的值,这就是我要使用字典的原因。
字典必须如下所示:
{'aa': [0,0,1,...,0], 'bb': [0,0,0,...,0],...}
当 dict key=df index and value 是表示为列表的行时,我怎样才能达到这样的结果?
【问题讨论】:
-
index 或
Name列(毕竟)? -
@RomanPerekhrest 索引是名称列
标签: python pandas dictionary