setwd("D://Desktop")
install.packages("jiebaRD")
library(jiebaRD)
install.packages("jiebaR")
library(jiebaR)
wk<-worker()
# 添加用戶自定義詞庫
wk<-worker(user="dictionary.txt")#好像添加了也沒用啊
# 洗掉停用詞
wk<-worker(stop_word="ChineseStopWords.txt")
# 讀取文本檔案
wk[file.choose()]
# 選擇分詞后的檔案
f<-scan(file.choose(),sep="\n",what="",encoding="UTF-8")
#統計詞頻及排序
df<-freq(wk[f])
df<-df[order(-df$freq),]
# 安裝sqldf包
install.packages("sqldf")
library("sqldf")
# 提取前100項
df<-sqldf("select[char],[freq] from df where length([char])>1 limit 100")
df<-df[nchar(df$char)>1,]
轉載請註明出處,本文鏈接:https://www.uj5u.com/shujuku/39778.html
標籤:疑難問題
