【发布时间】:2015-06-29 22:04:30
【问题描述】:
下面,如果它们出现在字典 benchmarks 中,我在 map 列的 map 函数中使用 lambda x: 值。
在示例中,符号 "GOOG" 被映射为 "Google" 到列 "full_name"。
我的问题是:如何对字典进行不区分大小写的检查?例如,"Aapl" 变为 "Apple",即使 "AAPL" 在字典中。
import pandas as pd
import re
df = pd.read_csv(file.csv, delimiter=",")
df = pd.DataFrame(["LONG GOOG VON", "Long Aapl X4 VON"], columns=["symbol"])
benchmarks = {"GOOG": "Google", "AAPL": "Apple"}
match = re.compile(r"\s(\S+)\s")
def f(value):
f1 = lambda x: benchmarks[match.findall(x)[0]] if match.findall(x)[0] in benchmarks else ""
stuff = f1(value)
#stuff done here is omitted
return stuff
df["full_name"] = df["symbol"].map(lambda x:f(x))
【问题讨论】:
-
flags=re.ignorecase怎么样?此外,您可能会考虑保存正则表达式搜索结果,而不是多次运行它。如果它是函数中唯一的东西,为什么你甚至需要一个 lambda?该函数甚至没有return任何东西。 -
@TigerhawkT3 根据 pandas 文档,这应该与
findall一起使用,但我一定做错了,因为当我输入findall(x, flags=re.IGNORECASE)时,它说'flags is an invalid keyword argument for this function' -
@TigerhawkT3 这是完整代码的一部分。退货在其他地方进行。
-
对于已编译的表达式,您必须在编译时而不是在搜索时放入标志,例如
re.compile(r"\s(\S+)\s", flags=re.IGNORECASE). -
啊,是的,我也尝试过。对
symbol中的单词进行了正则表达式匹配,但不使用字典进行翻译。
标签: python python-2.7 pandas lambda