【发布时间】:2021-04-18 19:47:39
【问题描述】:
我需要对 python 代码进行修改。
此代码从 .csv 文件中抓取信息,最终以不同的结构将其集成到新的 .csv 文件中。
在源文件的一列中,我有一个值(字符串),99% 的时间都是这样形成的:'block1 block2 block3'。
Block2 在 99% 的情况下总是以值 'm' 结束。
示例:“R2 180m RFT”。
通过浏览源数据集,我意识到在 1% 的情况下,block2 可以以“M”结尾。
因为我需要 'm' 或 'M' 值之后的所有值,所以我有点卡住了。
我使用了 .split() 函数,就像在我的 :
'Newcolumn': getattr(row_unique_ids, 'COLUMNINTHEDATASET').split ('m') [1],
这样做,我的脚本出错了,因为它落在了这种风格的值上: R2 180M AST'。
所以我想知道如何集成一个额外的参数,如果脚本落在“m”或“M”上,这将使我能够很好地进行拆分。
感谢您的帮助。
【问题讨论】:
-
是否有其他模式可以识别,例如在 m 或 M 之前总是有一个数字,所以如果它以一个数字结尾,你可以在那里拆分?
-
您可以在应用拆分之前将字符串转换为小写,您尝试过吗?
-
为什么不在空间分割,只获取结果列表的最后一个元素?
-
如果你必须有多个字符,
re.split可以适应这个。 -
这能回答你的问题吗? Python: Split string by list of separators
标签: python