我正在尝试进行主题提取,我所做的是从字符串中删除所有辅助词,我的伪代码是:
topic := make(map[string]int)
auxiliaryWord := []string{"hbs", "habis", "dan", "kapan", "bagaimana", "kita", "kamu", "warga", "pada", "paling", "ga", "gak", "enggak", "tidak", "bukan", "usai", "juga", "yg", "yang", "kpd", "kepada", "nya", "adanya", "jd", "jadi", "sih", "lah", "kan", "photo", "from", "by", "ini", "saja", "utk", "untuk", "lebih", "ternyata", "apa", "sok", "tau", "bagi", "eksis", "keluar", "kk", "kakak"}
for chat := range chats {
arrWord := chat.Split(chat, " ")
for word := arrWord {
if word not in auxiliaryWord {
if topic[word] not exist {
topic[word] = 1
} else {
topic[word]+= 1
}
}
}
}
我的问题是,有没有更快的方法来做到这一点?
波斯汪
相关分类