【发布时间】:2020-11-07 04:44:34
【问题描述】:
我需要删除单元格中的重复数字和重复 单元格中的百分比符号
我有两个输入:
输入1-
- 51 %
- 4% %
- (0.9 %)
- 53 %
- 44 %
- 29 %
名称:付费损失率,dtype:对象
要求的输出1:
- 51
- 4
- -0.9
- 53
- 44
- 29
名称:付费损失率,dtype:对象
以下脚本适用于这种情况:
f1['付费损失率'].str.split('%').apply(set).str.join('').str.rstrip()
尝试删除重复的“% 登录一个单元格”
输入2 -
-
88 % -
102 % - 84 84 %
-
( 0.8 % -
93 %
名称:Constant Loss Ratio,数据类型:object
要求输出2:
- 88 %
- 102%
- 84 %
- -0.8%
- 93 %
尝试以下方法但无法正常工作:
re.sub(r'([0-9])(.*)\1+', r'\1', str(ab))
尝试删除一个单元格中重复的“84”数字
还有没有办法合并这两个脚本/模式?
【问题讨论】:
-
df['col'].replace('%+','',regex=True).astype(float)有什么问题? -
@Manakin 这个也可以,所以我将这两个答案结合起来。谢谢! :)
-
@Manakin 我已经稍微更新了这个问题,如果我们有 -0.8% 或 -0.9% 之类的“括号”,你能看看你是否可以提供帮助
-
应该这样做
df[0].replace('%+','',regex=True).str.strip('()').astype(float)