【发布时间】:2019-04-15 11:46:16
【问题描述】:
现在我想用这些列括号内的数据替换“SIFT”和“PolyPhen”列的值。因此,对于第 1 行,SIFT 值将替换为 0.82,对于第 2 行,SIFT 值将替换为 0.85。我还想要括号前的部分,容忍/有害,在一个名为“SIFT_prediction”的新列中。
这是我迄今为止尝试过的:
import pandas as pd
import re
testfile = 'test_sift_columns.csv'
df = pd.read_csv(testfile)
df['SIFT'].re.search(r'\((.*?)\)',s).group(1)
此代码将获取 SIFT 列括号内的所有内容。但这并不能取代任何东西。我可能需要一个 for 循环来读取和替换每一行,但我不知道如何正确执行。此外,我不确定是否需要对 pandas 使用正则表达式。也许有更聪明的方法来解决我的问题。
【问题讨论】:
标签: python python-3.x pandas csv dataframe