位元組與字元統計

詞、行、UTF-8

即時統計 UTF-8 位元組、字元、詞、行和句子。免費線上位元組計數器。

統計在瀏覽器中完成,輸入內容不會上傳。

字元

0

字詞

0

行

0

Bytes (UTF-8)

0

  • 字元數(不含空白)0
  • 句0

輸入表單或 API 限制。空格、換行與表情符號都計入 UTF-8 位元組。

輸入

這個工具是什麼?

統計字元、去空白字元、詞、行、句子與 UTF-8 位元組。輸入時頂部 KPI 即時更新,不會上傳資料。

不同限制統計不同維度:UI 常限字元、資料庫常限位元組、文案常限詞數、API 關心編碼後體積。非 ASCII 往往一個字形對應多個 UTF-8 位元組。

常見用途

  • 檢查 meta、社群文案或表單的字元/位元組上限
  • 對比 UI 文案翻譯長度
  • 測量 API 或日誌 payload 的 UTF-8 位元組大小

如何使用

  1. 貼上或輸入文字。頂部 KPI(字元、詞、行、UTF-8 位元組)即時更新。
  2. 在晶片列查看去空白字元數與句子數。
  3. 用 Sample 對比 ASCII 與韓文/emoji 的位元組差異。
  4. 複製統計摘要或 Clear 清空。

範例

輸入 / 設定輸出說明
Hello world.chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12簡單 ASCII。
안녕하세요chars 5 · words 1 · UTF-8 15韓文音節多為 3 位元組 UTF-8。
Hi 👋chars 5 · words 2 · UTF-8 7👋 為 2 個 UTF-16 單元、4 個 UTF-8 位元組(合計 7)。
One.\nTwo!lines 2 · sentences 2 · words 2換行與句末標點。

檢查 UTF-8 位元組上限

輸入表單或 API 上限。上限為 10 位元組時,안녕😀 佔 10,剩餘 0;再加一個空格為 11,超出 1。複製的摘要包括上限與剩餘或超出量。

只統計原文,不含 JSON 引號、跳脫、HTTP 標頭或檔案中繼資料。Textarea 將換行正規化為 LF;以 CRLF 儲存的伺服器每次換行多一個位元組。UTF-8 與 Big5 等編碼不同。

實務上常見陷阱

  • UTF-8 位元組 ≠ 字元數:韓文、CJK、emoji 會抬高位元組;不要只用 length 估儲存配額。
  • 詞數依空白分割:無空白的中文通常計為 1 個詞——不是斷詞器。
  • 字元數是 JS 的 UTF-16 長度:部分 emoji 顯示為 1 個字形卻計為 2。
  • 句子以 . ! ? 啟發式偵測,縮寫可能多計。

參考資料

最後審閱: 2026-10-11

常見問題

為什麼 UTF-8 位元組數和字元數不同?
字元數是 JavaScript 字串長度(UTF-16 代碼單元);位元組數是 TextEncoder 的 UTF-8 大小。 非 ASCII(韓文、emoji、變音符號)通常占更多位元組;部分 emoji 為 2 個 UTF-16 單元、4 個 UTF-8 位元組。
詞數如何計算?
trim 後依空白(空格、定位、換行)分割;連續空白算一次分隔。無空白的中文等常計為 1 個詞。
句子數對所有語言都準嗎?
以 `.` `!` `?` 結尾為啟發式。縮寫(如 `Dr.`)或其他標點體系可能偏差。
文字會上傳嗎?
不會。統計僅在瀏覽器本機完成。
這個限制適用於 Big5 嗎?
不適用。這裡計算 UTF-8 原文位元組,與 Big5 不同。不含 JSON 引號、跳脫或 HTTP 標頭。伺服器使用 CRLF 時位元組數可能更多。