【发布时间】:2013-05-14 06:46:20
【问题描述】:
我有一个熊猫系列,目前看起来像这样:
14 [Yellow, Pizza, Restaurants]
...
160920 [Automotive, Auto Parts & Supplies]
160921 [Lighting Fixtures & Equipment, Home Services]
160922 [Food, Pizza, Candy Stores]
160923 [Hair Removal, Nail Salons, Beauty & Spas]
160924 [Hair Removal, Nail Salons, Beauty & Spas]
我想从根本上将它重塑成一个看起来像这样的数据框......
Yellow Automotive Pizza
14 1 0 1
…
160920 0 1 0
160921 0 0 0
160922 0 0 1
160923 0 0 0
160924 0 0 0
即。一个逻辑结构,指出每个观察(行)属于哪些类别。
我能够编写基于循环的代码来解决问题,但鉴于我需要处理大量行,这将非常慢。
有人知道此类问题的矢量化解决方案吗?我将不胜感激。
编辑:有 509 个类别,我有一个列表。
【问题讨论】:
标签: python pandas categories vectorization