位元組與字元統計

詞、行、UTF-8

即時統計 UTF-8 位元組、字元、詞、行和句子。免費線上位元組計數器。

此轉換僅在您的瀏覽器中執行,不會上傳任何內容。

Counts run locally in your browser — nothing is uploaded.

字元

0

字詞

0

0

Bytes (UTF-8)

0

  • Characters (no spaces)0
  • 0

輸入

這個工具是什麼?

統計字元、去空白字元、、句子與 UTF-8 位元組。輸入時頂部 KPI 即時更新,不會上傳資料。

不同限制統計不同維度:UI 常限字元、資料庫常限位元組、文案常限詞數、API 關心編碼後體積。非 ASCII 往往一個字形對應多個 UTF-8 位元組。

常見用途

  • 檢查 meta、社群文案或表單的字元/位元組上限
  • 對比 UI 文案翻譯長度
  • 測量 API 或日誌 payload 的 UTF-8 位元組大小

如何使用

  1. 貼上或輸入文字。頂部 KPI(字元、詞、行、UTF-8 位元組)即時更新。
  2. 在晶片列查看去空白字元數與句子數。
  3. 用 Sample 對比 ASCII 與韓文/emoji 的位元組差異。
  4. 複製統計摘要或 Clear 清空。

範例

輸入 / 設定輸出說明
Hello world.chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12簡單 ASCII。
안녕하세요chars 5 · words 1 · UTF-8 15韓文音節多為 3 位元組 UTF-8。
Hi 👋chars 5 · words 2 · UTF-8 7👋 為 2 個 UTF-16 單元、4 個 UTF-8 位元組(合計 7)。
One.\nTwo!lines 2 · sentences 2 · words 2換行與句末標點。

實務上常見陷阱

  • UTF-8 位元組 ≠ 字元數:韓文、CJK、emoji 會抬高位元組;不要只用 length 估儲存配額。
  • 詞數依空白分割:無空白的中文通常計為 1 個詞——不是斷詞器。
  • 字元數是 JS 的 UTF-16 長度:部分 emoji 顯示為 1 個字形卻計為 2
  • 句子以 . ! ? 啟發式偵測,縮寫可能多計。

參考資料

最後審閱: 2026-07-27

常見問題

為什麼 UTF-8 位元組數和字元數不同?
字元數是 JavaScript 字串長度(UTF-16 代碼單元);位元組數是 TextEncoder 的 UTF-8 大小。 非 ASCII(韓文、emoji、變音符號)通常占更多位元組;部分 emoji 為 2 個 UTF-16 單元、4 個 UTF-8 位元組。
詞數如何計算?
trim 後依空白(空格、定位、換行)分割;連續空白算一次分隔。無空白的中文等常計為 1 個詞。
句子數對所有語言都準嗎?
以 `.` `!` `?` 結尾為啟發式。縮寫(如 `Dr.`)或其他標點體系可能偏差。
文字會上傳嗎?
不會。統計僅在瀏覽器本機完成。