Я пытаюсь получить скользящие средние для многих столбцов одновременно, но у меня возникают трудности, потому что мои группирующие переменные не являются числовыми.
Если бы я выполнял скользящее среднее для одного столбца за раз, мой код выглядел бы примерно так:
NHLReg2<-arrange(NHLReg2,season,team,gameId) %>% group_by(season,team)%>% mutate(xGF= rollapply(xGoalsFor, list( seq(21)), sum, partial = TRUE, fill = NA))
Я попытался использовать dplyr для одновременного создания множества столбцов:
NHLPP3<-arrange(NHLPP2,season,team,gameId) %>%
group_by(season,team)%>%
select(c(1,2,11:112)) %>%
lapply(function(x){ if(class(x) == "numeric"){
rollapply(x, width=list(-seq(21)), FUN=function(x){sum(x,
na.rm=T)},partial = T, fill = NA)
}else{
return(x)
}
})%>% as.data.frame()
Это решает проблему игнорирования переменных символов/группировки для rollapply, но приводит к тому, что оператор groupby не имеет никакого эффекта. Я оставил несколько примеров данных ниже, предположим, что v1 и v2 — это группирующие переменные, а v3 и v4 — столбцы, представляющие интерес для расчета скользящего среднего.
v1<-c('a','a','a','a','a','a','a','a','b','b','b','b','b','b','b')
v2<-c('2010','2010','2010','2010','2010','2010','2010','2010','2020','2020','2020','2020','2020','2020','2020')
v3<-c(1,2,3,4,1,4,5,6,13,5,6,13,4,65,8)
v4<-c(6,13,5,6,13,4,65,8,1,2,3,4,1,4,5)
Data<-as.data.frame(t(rbind(v1,v2,v3,v4)))
Спасибо.
mutate_if
илиmutate_at
? (Также я бы рекомендовал использовать больше пробелов и отступов в вашем коде, чтобы он оставался читабельным.) - person Axeman   schedule 04.02.2020