【发布时间】:2017-10-29 01:32:32
【问题描述】:
我在 csv 文件中有一个单词的 pos-tag 列表,例如每个单词都有他的 pos 标签:
[(什么,WP) (制作,VBZ) (他们,PRP) (做,VB) (它,PRP)] 等等……
我希望节点是 TAG(WP、VBZ、PRP..),并且边缘的属性是连续形式的,例如边缘列表将是:
[(什么,做什么) (使,他们) (他们,做) (做,它)] 它... 所以我可以删除重复的节点,但仍然有所有属性从节点出去并进入.. 到目前为止我有这个
G=nx.MultiGraph()
files = glob.glob('C:/Users/Sebastian/Desktop/prueba3/*.csv')
for path in files:
dirname, filename = os.path.split(path)
with open ('C:/Users/Sebastian/Desktop/prueba3/%s' %filename) as csvfile:
csv_reader = csv.reader(csvfile, delimiter=',')
for row in csv_reader:
new_node = row[1]
new_attributes = row[:1]
G.add_node(new_node, my_attributes=new_attributes)
【问题讨论】: