原始資料集
我只想獲取變數中一個級別的計數最多的值?我的代碼如下:
`
a <- format_separated %>%
group_by(state, format) %>%
summarise(total = n(),
.groups = "drop") %>%
arrange(desc(total))
`
| 狀態 | 格式 | 全部的 |
|---|---|---|
| 加利福尼亞 | 公共廣播 | 25 |
| 紐約 | 國家 | 17 |
| 俄亥俄州 | 古典 | 14 |
| 紐約 | 公共廣播 | 12 |
(1015 個條目)
但我只想像這樣獲得每個狀態的最重要的格式:
| 狀態 | 格式 | 全部的 |
|---|---|---|
| 加利福尼亞 | 公共廣播 | 25 |
| 紐約 | 國家 | 17 |
| 俄亥俄州 | 古典 | 14 |
| 佛羅里達 | 公共廣播 | 11 |
(46 個條目)
我打算獲得的最終資料集應該包括美國的 50 個州,不應重復。
uj5u.com熱心網友回復:
library(tidyverse)
df <- read_csv("https://raw.githubusercontent.com/rfordatascience/tidytuesday/master/data/2022/2022-11-08/state_stations.csv")
df %>%
count(state, format, sort = TRUE) %>%
group_by(state) %>%
slice_head() %>%
arrange(-n)
# A tibble: 50 x 3
# Groups: state [50]
state format n
<chr> <chr> <int>
1 Texas Country 148
2 California Variety 116
3 Kentucky Country 71
4 Tennessee Country 68
5 Missouri Country 66
6 Minnesota Country 62
7 Illinois Country 59
8 New_York Country 52
9 Arkansas Country 51
10 Georgia Country 51
# ... with 40 more rows
# i Use `print(n = ...)` to see more rows
轉載請註明出處,本文鏈接:https://www.uj5u.com/caozuo/529437.html
上一篇:用對應的代碼R替換部分字串
