【发布时间】:2020-06-25 12:29:34
【问题描述】:
我想使用哈希图替换给定 df 列的值,但我在语法上遇到了困难。 有人可以指出我正确的方向或现有的例子吗?我搜索过但是 找不到能阐明确切主题的东西。
编辑:
想象一个如下图所示的数据框:
+-----------+--------+-----------+
| Noun| Pronoun| Adjective|
+-----------+--------+-----------+
| Homer| Simpson|BeerDrinker|
| Marge| Simpson| Housewife|
| Bart| Simpson| Son|
| Lisa| Simpson| Daughter|
|TheSimpsons|Simpsons| Family|
+-----------+--------+-----------+
我有一个如下所示的键值对映射:
type ValueMap = scala.collection.mutable.HashMap [String,String]
var mymap = new ValueMap ()
mymap += ("Simpson" -> "Surname")
我想做一个操作(我目前还无法弄清楚)并获得如下所示的结果。所以基本上在Pronoun 列中,所有等于Simpson 的列值都已替换为来自映射mymap 的对应值Surname
+-----------+--------+-----------+
| Noun| Pronoun| Adjective|
+-----------+--------+-----------+
| Homer| Surname|BeerDrinker|
| Marge| Surname| Housewife|
| Bart| Surname| Son|
| Lisa| Surname| Daughter|
|TheSimpsons|Simpsons| Family|
+-----------+--------+-----------+
【问题讨论】:
-
你能澄清一下替换是什么意思吗?也许提供一个输入数据是什么以及结果应该是什么的例子
-
嗨@AlexOtt,我已经用一个例子更新了我的程序。我希望这有助于突出我的目标。
-
我认为这应该回答您的问题:stackoverflow.com/questions/56557771/…(请参阅有关处理不存在密钥的评论)
-
嗨@Alex:谢谢。是的,它确实解决了问题。不幸的是,我一直在搜索“HashMap”而不是“Map”——只有我这样做了——我才会找到上述帖子。没关系。感谢您向我指出这一点。非常感激!干杯。
标签: scala dataframe apache-spark hashmap transform