詞頻統計器
分析文字並統計每個詞出現的次數,按頻率排序。
什麼是詞頻統計器?
詞頻統計器(Word Frequency Analyzer)是一款文字分析工具,能夠快速掃描您所提供的文本,並計算每個統計單位出現的頻率(次數)。結果按出現次數由高到低排列,並以百分比呈現相對比重,讓您一眼掌握文章的用字重心。統計單位講清楚:中文(含日文假名、韓文諺文)以每個字計,英文與數字以每個單詞計,中英混排會兩種一起列出,結果表上方也會標明這次切出多少中文字、多少英數詞。
如何使用詞頻統計器?
- 步驟一:在文字框中貼上或輸入您要分析的文字內容(支援中文、英文及混合文字)。
- 步驟二:設定「顯示前 N 個詞」,決定最多顯示幾個高頻詞。
- 步驟三:設定「最短詞長」,過濾過短的英文單字(建議 2 字元以上)。這一項只套用在英數詞:中文是以「每個字」統計,token 天生就是 1 個字元,若一併套用會把中文整批濾光(2026-07-26 之前正是如此,純中文貼進來會直接跳錯誤訊息)。
- 步驟四:勾選「過濾常見停用詞」,可自動移除「的」「了」「是」等常見虛詞,讓結果更具意義。
- 步驟五:點擊「分析詞頻」按鈕,系統立即計算並顯示結果表格。
- 步驟六:您可點擊「匯出 CSV」將結果下載儲存,或「複製結果」貼至其他應用程式。
詞頻分析的常見應用場景
- 📝 學術研究:分析論文或文獻中的核心關鍵詞,快速了解研究重點。
- 📣 SEO 優化:檢視網頁文章的關鍵詞分佈,確保目標詞彙出現頻率適當。
- 📚 語言學習:統計閱讀材料的高頻詞彙,制定精準的單字學習計畫。
- 🗞️ 新聞分析:找出新聞報導中反覆出現的主題詞,掌握輿論焦點。
- 💼 商業報告:分析客戶回饋或市場調查文字,識別最常被提及的議題。
- ✍️ 寫作改善:檢查自己的文章是否過度重複某些詞彙,增加表達多樣性。
常見問題 FAQ
Q:此工具支援中文分詞嗎?
老實說:不做中文斷詞。瀏覽器端沒有中文斷詞辭典,本工具不會、也不假裝會把「人工智慧」切成一個詞,而是以每一個字為統計單位(日文假名、韓文諺文同理);英文與數字則以每一個單詞為單位,並轉成小寫。所以中文的結果讀起來是「單字頻率」而不是「詞彙頻率」,用來看用字習慣、重複程度沒問題,要看專有名詞就得自己合併判讀。另外「最短詞長」只套用在英數詞——2026-07-26 之前它連中文也一起套,導致純中文貼進來一律跳「過濾後沒有剩餘詞彙」,等於完全不能用,這個已經修好。
Q:什麼是停用詞?為什麼要過濾?
停用詞(Stop Words)是在語言中出現頻率極高、但本身語意較低的詞彙,例如中文的「的」「了」「在」「是」,或英文的 "the"、"a"、"is" 等。過濾停用詞後,統計結果能更清楚地反映文章中真正有意義的關鍵詞彙。
Q:分析時會區分大小寫嗎?
不會。本工具在統計前會將所有英文字母統一轉換為小寫,因此 "Apple"、"apple"、"APPLE" 均視為同一個詞,不會重複計算。
Q:匯出的 CSV 檔案包含哪些資訊?
匯出的 CSV 檔案包含四欄:排名(Rank)、詞語(Word)、出現次數(Count)及佔比百分比(Percentage),可直接以 Excel、Google Sheets 等試算表軟體開啟進行進一步分析。
Q:文字長度有限制嗎?
本工具在瀏覽器端進行運算,理論上沒有強制限制,但建議文字量在 50 萬字以內,以確保分析速度流暢。處理超大型文件時,頁面可能需要稍等片刻。
Q:我的文字內容會被上傳到伺服器嗎?
不會。所有分析運算均在您的瀏覽器本地端(Client-side)執行,文字內容不會傳送至任何伺服器,請放心使用。
