我想我对你的问题有一个解决方案。使用来自 dplyr 的 separate_rows 函数。
您需要做的是将变量 away_lineup 分成几行,其中每个新观察都是原始观察的副本,允许您按 away_lineup 和 game_id 分组以获得您已经对詹姆斯哈登所做的总结
试试这个代码。
librar(tidyverse)
data %>%
separate_rows(away_lineup, sep = ',') %>%
mutate(away_lineup = str_trim(away_lineup),
play_length = parse_number(play_length)) %>%
group_by(game_id, away_lineup) %>%
summarise(minute = sum(play_length)/60)
数据
data <- structure(list(away_lineup = c("James Harden, Carmelo Anthony, Eric Gordon, Michael Carter-Williams, PJ Tucker",
"Clint Capela, James Harden, Carmelo Anthony, Eric Gordon, Michael Carter-Williams",
"Clint Capela, James Harden, Carmelo Anthony, Eric Gordon, Michael Carter-Williams",
"Clint Capela, James Harden, Carmelo Anthony, Eric Gordon, Michael Carter-Williams",
"James Ennis III, Clint Capela, Eric Gordon, James Harden, Carmelo Anthony",
"James Ennis III, Clint Capela, Eric Gordon, James Harden, Carmelo Anthony",
"James Ennis III, Clint Capela, Eric Gordon, James Harden, Carmelo Anthony",
"James Ennis III, Clint Capela, Eric Gordon, James Harden, Carmelo Anthony",
"Clint Capela, Eric Gordon, James Harden, Carmelo Anthony, Gerald Green",
"Clint Capela, Eric Gordon, James Harden, Carmelo Anthony, Gerald Green",
"James Harden, Eric Gordon, Gary Clark, Isaiah Hartenstein, Chris Paul",
"James Harden, Eric Gordon, Gary Clark, Isaiah Hartenstein, Chris Paul",
"James Harden, Eric Gordon, Gary Clark, Isaiah Hartenstein, Chris Paul",
"James Harden, Eric Gordon, Gary Clark, Isaiah Hartenstein, Chris Paul",
"James Harden, Eric Gordon, Gary Clark, Isaiah Hartenstein, Chris Paul",
"James Harden, Eric Gordon, Gary Clark, Isaiah Hartenstein, Chris Paul",
"James Harden, Eric Gordon, Gary Clark, Isaiah Hartenstein, Chris Paul",
"PJ Tucker, Clint Capela, James Harden, Austin Rivers, Gerald Green",
"PJ Tucker, Clint Capela, James Harden, Austin Rivers, Gerald Green",
"PJ Tucker, Clint Capela, James Harden, Austin Rivers, Gerald Green",
"PJ Tucker, Clint Capela, James Harden, Austin Rivers, Gerald Green",
"PJ Tucker, Clint Capela, James Harden, Austin Rivers, Gerald Green",
"PJ Tucker, Clint Capela, James Harden, Austin Rivers, Gerald Green",
"PJ Tucker, Clint Capela, James Harden, Austin Rivers, Gerald Green",
"Danuel House Jr., Austin Rivers, Gerald Green, James Harden, PJ Tucker",
"Danuel House Jr., Austin Rivers, Gerald Green, James Harden, PJ Tucker",
"Danuel House Jr., Austin Rivers, Gerald Green, James Harden, PJ Tucker",
"Danuel House Jr., Austin Rivers, Gerald Green, James Harden, PJ Tucker",
"Danuel House Jr., Austin Rivers, Gerald Green, James Harden, PJ Tucker",
"PJ Tucker, James Harden, Gerald Green, Danuel House Jr., James Ennis III",
"PJ Tucker, James Harden, Gerald Green, Danuel House Jr., James Ennis III",
"PJ Tucker, James Harden, Gerald Green, Danuel House Jr., James Ennis III",
"PJ Tucker, James Harden, Gerald Green, Danuel House Jr., James Ennis III"
), play_length = c("0S", "13S", "9S", "4S", "19S", "6S", "8S",
"0S", "0S", "18S", "11S", "9S", "13S", "12S", "3S", "7S", "5S",
"7S", "24S", "9S", "19S", "7S", "19S", "16S", "17S", "2S", "15S",
"3S", "2S", "1S", "9S", "2S", "2S"), game_id = c(21800009, 21800009,
21800009, 21800009, 21800039, 21800039, 21800039, 21800039, 21800039,
21800039, 21800180, 21800180, 21800180, 21800180, 21800180, 21800180,
21800180, 21800512, 21800512, 21800512, 21800512, 21800512, 21800512,
21800512, 21800565, 21800565, 21800565, 21800565, 21800565, 21800610,
21800610, 21800610, 21800610)), row.names = c(NA, -33L), class = c("tbl_df",
"tbl", "data.frame"))
请告诉我是否是您想要的。