バイト・文字数カウント

単語・行・UTF-8

UTF-8バイト、文字、単語、行、文を即座にカウント。無料のオンラインバイトカウンターです。

ブラウザ内で集計します。入力内容はアップロードされません。

文字

0

単語

0

行

0

Bytes (UTF-8)

0

  • 文字数(空白を除く)0
  • 文0

フォームやAPIの上限を指定。空白・改行・絵文字もUTF-8バイト数に含まれます。

入力

このツールについて

文字数・空白除く文字数・単語・行・文・UTF-8 バイトをまとめて数えます。入力すると KPI が即更新され、アップロードはありません。

UI は文字、DB はバイト、原稿は単語、API はエンコードサイズを制限することがあります。日本語・絵文字は見た目より UTF-8 バイトが大きくなりがちです。

よくある用途

  • メタ説明・SNS・入力欄の文字/バイト上限チェック
  • UI コピー翻訳の長さ比較
  • API・ログペイロードの UTF-8 バイト確認

使い方

  1. テキストを貼り付けます。上部 KPI(文字・単語・行・UTF-8 バイト)がすぐ更新されます。
  2. チップ行で空白除く文字数・文数を確認します。
  3. Sample で ASCII と日本語・絵文字のバイト差を見ます。
  4. 統計サマリーをコピーするか Clear します。

例

入力 / 設定出力メモ
Hello world.chars 12 · no-spaces 11 · words 2 · lines 1 · sentences 1 · UTF-8 12単純 ASCII。
こんにちはchars 5 · words 1 · UTF-8 15ひらがなは UTF-8 で多バイト。
Hi 👋chars 5 · words 2 · UTF-8 7👋 は UTF-16 で 2、UTF-8 で 4(合計 7)。
One.\nTwo!lines 2 · sentences 2 · words 2改行と文末記号を反映。

UTF-8バイト上限を確認

フォームやAPIの上限を指定します。10バイト上限なら 안녕😀 は10バイトで残り0。空白を足すと11バイト、1バイト超過です。コピーする集計には上限と残り・超過も含みます。

入力本文のみで、JSONの引用符・エスケープ、HTTPヘッダー、メタデータは含みません。Textareaは改行をLFに統一します。CRLFで保存するサーバーは改行ごとに1バイト増えます。UTF-8とShift_JISなどは異なります。

実務での落とし穴

  • UTF-8 バイト ≠ 文字数: 日本語・CJK・絵文字では保存上限に length だけでは足りません。
  • 単語は空白区切り: 空白のない日本語は 単語 1 になりやすい(形態素解析ではありません)。
  • 文字数は JS の UTF-16 長です。一部の絵文字は見た目 1 でも 2 と数えます。
  • 文は . ! ? ヒューリスティックで、略語で過大になることがあります。

参考資料

最終更新: 2026-10-11

よくある質問

UTF-8 バイトと文字数が違うのはなぜ?
文字数は JavaScript の文字列長(UTF-16 コードユニット)、バイトは TextEncoder の UTF-8 サイズです。 日本語・絵文字などは見た目よりバイトが多く、一部の絵文字は UTF-16 で 2、UTF-8 で 4 です。
単語はどう数えますか?
trim 後に空白(スペース・タブ・改行)で分割します。連続空白は 1 区切りです。 空白のない日本語・CJK は単語 1 として数えられることがあります。
文数は常に正確ですか?
`.` `!` `?` で終わる区間のヒューリスティックです。略語や句点の違う文書ではずれることがあります。
テキストはアップロードされますか?
いいえ。カウントはブラウザ内だけです。
バイト上限をShift_JISの制限に使えますか?
いいえ。この値はUTF-8本文で、Shift_JISとは異なります。JSONの引用符やHTTPヘッダーは含みません。CRLFで保存するサーバーはLF入力よりバイト数が増えます。