Подтвердить что ты не робот

Как использовать dplyr для генерации частотной таблицы

Мне нравится создавать таблицу с частотой нескольких столбцов в моем фрейме данных. Я копирую часть своего фрейма данных ниже.

Предполагается, что в таблице должна быть частота (как n, так и%) "красного цвета" в цвете и "F" в поле "Пол".

Я думаю, что пакет dplyr мог это сделать, но я не могу понять.

Спасибо -

    RespondentID    Color        Gender   
1     1503          Red           F      
2     1653          NA            M   
3     1982          Red           F   
4     4862          Red           NA   
15    4880          Blue          M  

4b9b3361

Ответ 1

library(dplyr)

df %>%
  count(Color, Gender) %>%
  mutate(prop = prop.table(n))

# Source: local data frame [4 x 4]
# Groups: Color [3]
# 
#    Color Gender     n      prop
#   (fctr) (fctr) (int)     (dbl)
# 1   Blue      M     1 1.0000000
# 2    Red      F     2 0.6666667
# 3    Red     NA     1 0.3333333
# 4     NA      M     1 1.0000000

Обновление для комментария - если вы хотите посмотреть на каждую переменную отдельно, вам сначала необходимо сначала изменить структуру данных. Вы можете выполнить это с помощью tidyr:

library(tidyr)
library(dplyr)

gather(df, "var", "value", -RespondentID) %>%
  count(var, value) %>%
  mutate(prop = prop.table(n))

# Source: local data frame [6 x 4]
# Groups: var [2]
# 
#      var value     n  prop
#   (fctr) (chr) (int) (dbl)
# 1  Color  Blue     1   0.2
# 2  Color   Red     3   0.6
# 3  Color    NA     1   0.2
# 4 Gender     F     2   0.4
# 5 Gender     M     2   0.4
# 6 Gender    NA     1   0.2