【发布时间】:2023-03-05 07:21:01
【问题描述】:
更新和简化
我有一个非常大的表(约 700 万条记录),其结构如下。
temp <- read.table(header = TRUE, stringsAsFactors=FALSE,
text = "Website Datetime Rating
A 2007-12-06T14:53:07Z 1
A 2006-07-28T03:52:26Z 4
B 2006-11-02T11:06:25Z 2
C 2007-06-19T06:56:08Z 5
C 2009-11-28T22:27:58Z 2
C 2009-11-28T22:28:13Z 2")
我要检索的是每个网站评分最高的唯一网站:
Website Rating
A 4
B 2
C 5
我尝试使用 for 循环,但它太慢了。有没有其他方法可以实现这一点。
【问题讨论】:
-
我会
split数据并使用lapply浏览每个网站,应用您的标准。通过提供可重复的示例和预期结果来帮助我们节能人士。 -
感谢罗曼!我更新了我的问题并使其更加具体。你能给我举个例子,说明如何将 split 与 lapply 结合以获得所需的结果?
-
我认为@RomanLuštrik 提到的
split和lapply的想法与DWin 在他的回答中的观点一致。另外,请参阅我的答案的更新,以匹配满足您条件的 all 行。
标签: r