【发布时间】:2020-05-13 17:36:19
【问题描述】:
我有一个大数据框,其中每一行都包含一个字符串。 我想将每个字符串分成几列,同时替换两种字符类型。
下面的代码可以完成这项工作,但在大型数据帧上速度很慢。有没有比使用 for 循环更快的方法?
import re
import pandas as pd
df = pd.DataFrame(['[3.4, 3.4, 2.5]', '[3.4, 3.4, 2.5]'])
df_new = pd.DataFrame({'col1': [0,0], 'col2': [0,0], 'col3': [0,0]})
for i in range(df.shape[0]):
df_new.iloc[i, :] = re.split(',', df.iloc[i, 0].replace('[', '').replace(']', ''))
【问题讨论】:
标签: python pandas dataframe replace split