【发布时间】:2016-11-30 11:14:06
【问题描述】:
我有一个包含 4 列 13 行的 data.frame。下面是样本数据。 [列名大写,数据小写]
示例输入数据:
NAME. MARKS MONTH COUNTRY
ram 20. jan India
ranjith 40. jan India
naren. 80. jan. India
Amir. 90. feb. India
kumar. 60. feb India
azhar 80. feb India
mark 90. feb. US
Alex. 55 feb. US
chris 20 feb US
rakesh 60. jan US
Mona. 70. jan. US
mano. 90. mar. UK
Ron. 37. mar. UK
预期输出:
NAME MARKS. MONTH COUNTRY
naren 80. jan. India
ranjith 40. jan. India
Amir. 90. feb. India
Azhar. 80. feb. India
mark. 90. feb. US
Alex 55. feb. US
Mona. 70. jan. US
Rakesh. 60. jan. US
mano. 90. mar. UK
Ron. 37. mar. UK
问题:从输入数据框中,我只想从每个名为 MONTH 和 COUNTRY 的组中选择最高的两个标记值。上面给出了示例输出。
任何人都可以分享示例代码以生成正确的输出并将其分配给新的数据帧。任何方法都可取,包括sqldf。
【问题讨论】:
-
你的
.s 会打乱分组,除非它们是一致的。此外,您的数字看起来很可能是字符串,而不是实际数字。 -
Alistaire..那些我手动输入的数字没有粘贴。所以请忽略错字。通过忽略“。”将它们视为数字。