位元組與字元統計
詞、行、UTF-8
即時統計 UTF-8 位元組、字元、詞、行和句子。免費線上位元組計數器。
此轉換僅在您的瀏覽器中執行,不會上傳任何內容。
Counts run locally in your browser — nothing is uploaded.
字元
0
字詞
0
行
0
Bytes (UTF-8)
0
- Characters (no spaces)0
- 句0
輸入
這個工具是什麼?
統計字元、去空白字元、詞、行、句子與 UTF-8 位元組。輸入時頂部 KPI 即時更新,不會上傳資料。
不同限制統計不同維度:UI 常限字元、資料庫常限位元組、文案常限詞數、API 關心編碼後體積。非 ASCII 往往一個字形對應多個 UTF-8 位元組。
常見用途
- 檢查 meta、社群文案或表單的字元/位元組上限
- 對比 UI 文案翻譯長度
- 測量 API 或日誌 payload 的 UTF-8 位元組大小
如何使用
- 貼上或輸入文字。頂部 KPI(字元、詞、行、UTF-8 位元組)即時更新。
- 在晶片列查看去空白字元數與句子數。
- 用 Sample 對比 ASCII 與韓文/emoji 的位元組差異。
- 複製統計摘要或 Clear 清空。
範例
| 輸入 / 設定 | 輸出 | 說明 |
|---|---|---|
Hello world. | chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12 | 簡單 ASCII。 |
안녕하세요 | chars 5 · words 1 · UTF-8 15 | 韓文音節多為 3 位元組 UTF-8。 |
Hi 👋 | chars 5 · words 2 · UTF-8 7 | 👋 為 2 個 UTF-16 單元、4 個 UTF-8 位元組(合計 7)。 |
One.\nTwo! | lines 2 · sentences 2 · words 2 | 換行與句末標點。 |
實務上常見陷阱
- UTF-8 位元組 ≠ 字元數:韓文、CJK、emoji 會抬高位元組;不要只用
length估儲存配額。 - 詞數依空白分割:無空白的中文通常計為 1 個詞——不是斷詞器。
- 字元數是 JS 的 UTF-16 長度:部分 emoji 顯示為 1 個字形卻計為 2。
- 句子以
.!?啟發式偵測,縮寫可能多計。
參考資料
最後審閱: 2026-07-27
常見問題
- 為什麼 UTF-8 位元組數和字元數不同?
- 字元數是 JavaScript 字串長度(UTF-16 代碼單元);位元組數是 TextEncoder 的 UTF-8 大小。 非 ASCII(韓文、emoji、變音符號)通常占更多位元組;部分 emoji 為 2 個 UTF-16 單元、4 個 UTF-8 位元組。
- 詞數如何計算?
- trim 後依空白(空格、定位、換行)分割;連續空白算一次分隔。無空白的中文等常計為 1 個詞。
- 句子數對所有語言都準嗎?
- 以 `.` `!` `?` 結尾為啟發式。縮寫(如 `Dr.`)或其他標點體系可能偏差。
- 文字會上傳嗎?
- 不會。統計僅在瀏覽器本機完成。