バイト・文字数カウント
単語・行・UTF-8
UTF-8バイト、文字、単語、行、文を即座にカウント。無料のオンラインバイトカウンターです。
ブラウザ内で集計します。入力内容はアップロードされません。
文字
0
単語
0
行
0
Bytes (UTF-8)
0
- 文字数(空白を除く)0
- 文0
フォームやAPIの上限を指定。空白・改行・絵文字もUTF-8バイト数に含まれます。
入力
このツールについて
文字数・空白除く文字数・単語・行・文・UTF-8 バイトをまとめて数えます。入力すると KPI が即更新され、アップロードはありません。
UI は文字、DB はバイト、原稿は単語、API はエンコードサイズを制限することがあります。日本語・絵文字は見た目より UTF-8 バイトが大きくなりがちです。
よくある用途
- メタ説明・SNS・入力欄の文字/バイト上限チェック
- UI コピー翻訳の長さ比較
- API・ログペイロードの UTF-8 バイト確認
使い方
- テキストを貼り付けます。上部 KPI(文字・単語・行・UTF-8 バイト)がすぐ更新されます。
- チップ行で空白除く文字数・文数を確認します。
- Sample で ASCII と日本語・絵文字のバイト差を見ます。
- 統計サマリーをコピーするか Clear します。
例
| 入力 / 設定 | 出力 | メモ |
|---|---|---|
Hello world. | chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12 | 単純 ASCII。 |
こんにちは | chars 5 · words 1 · UTF-8 15 | ひらがなは UTF-8 で多バイト。 |
Hi 👋 | chars 5 · words 2 · UTF-8 7 | 👋 は UTF-16 で 2、UTF-8 で 4(合計 7)。 |
One.\nTwo! | lines 2 · sentences 2 · words 2 | 改行と文末記号を反映。 |
UTF-8バイト上限を確認
フォームやAPIの上限を指定します。10バイト上限なら 안녕😀 は10バイトで残り0。空白を足すと11バイト、1バイト超過です。コピーする集計には上限と残り・超過も含みます。
入力本文のみで、JSONの引用符・エスケープ、HTTPヘッダー、メタデータは含みません。Textareaは改行をLFに統一します。CRLFで保存するサーバーは改行ごとに1バイト増えます。UTF-8とShift_JISなどは異なります。
実務での落とし穴
- UTF-8 バイト ≠ 文字数: 日本語・CJK・絵文字では保存上限に
lengthだけでは足りません。 - 単語は空白区切り: 空白のない日本語は 単語 1 になりやすい(形態素解析ではありません)。
- 文字数は JS の UTF-16 長です。一部の絵文字は見た目 1 でも 2 と数えます。
- 文は
.!?ヒューリスティックで、略語で過大になることがあります。
参考資料
最終更新: 2026-10-11
よくある質問
- UTF-8 バイトと文字数が違うのはなぜ?
- 文字数は JavaScript の文字列長(UTF-16 コードユニット)、バイトは TextEncoder の UTF-8 サイズです。 日本語・絵文字などは見た目よりバイトが多く、一部の絵文字は UTF-16 で 2、UTF-8 で 4 です。
- 単語はどう数えますか?
- trim 後に空白(スペース・タブ・改行)で分割します。連続空白は 1 区切りです。 空白のない日本語・CJK は単語 1 として数えられることがあります。
- 文数は常に正確ですか?
- `.` `!` `?` で終わる区間のヒューリスティックです。略語や句点の違う文書ではずれることがあります。
- テキストはアップロードされますか?
- いいえ。カウントはブラウザ内だけです。
- バイト上限をShift_JISの制限に使えますか?
- いいえ。この値はUTF-8本文で、Shift_JISとは異なります。JSONの引用符やHTTPヘッダーは含みません。CRLFで保存するサーバーはLF入力よりバイト数が増えます。