Unicode エスケープ エンコーダー & デコーダー
テキストをUnicodeエスケープシーケンス(\uXXXX)に変換、または逆にデコードします。コードや設定ファイルの特殊文字処理に便利です。
この変換はブラウザ内だけで実行され、サーバーへはアップロードされません。
\uXXXX は UTF-16 コード単位(絵文字はサロゲートペア)。Hex は UTF-8 バイト(\xXX)。HTML は &#x…; 数値実体です。
- 入力0
- 出力0
- オプションUnicode (\uXXXX)
入力
出力
このツールについて
Unicode エスケープ エンコーダー/デコーダーは、読みやすいテキストとエスケープ表記を相互変換します。
- Unicode (
\uXXXX) — UTF-16 コード単位(JSON/JS 文字列)。絵文字などはサロゲートペア。 - Hex (
\xXX) — UTF-8 バイト単位。 - HTML (
&#x…;) — 16 進の数値文字参照。
エスケープは暗号化ではありません。入力に応じて結果が即時更新され、処理はブラウザ内だけです。
よくある用途
- API・アプリログの
\uXXXXを読む - 日本語・絵文字を含む JSON/JS 文字列エスケープの準備
- 同じ文字の UTF-16 エスケープと UTF-8
\xXXの比較
使い方
- Encode または Decode を選びます。入力や形式の変更で結果がすぐ更新されます。
- デバッグ対象に合わせて Unicode / Hex / HTML を選びます。
- テキストまたはエスケープを貼り付けます。Sample は
안녕 😀(または対応エスケープ)です。 - 結果をコピーします。メタに文字数と U+ コードポイントのプレビューが出ます。
例
| 入力 / 設定 | 出力 | メモ |
|---|---|---|
Hi → Unicode エンコード | \u0048\u0069 | BMP は \uXXXX 一つ |
Hi → Hex エンコード | \x48\x69 | ASCII の UTF-8 バイト |
\uD83D\uDE00 → Unicode デコード | 😀 | サロゲートペア → U+1F600 |
A → HTML デコード | A | 16 進 HTML 実体 |
混在ログと不正な入力
選択した形式のみ変換し、通常の文字は保持します。Hexでは status=\xec\x95\x88;ok が status=안;ok になります。途中で切れた \xec\x95 は置換文字ではなくエラーを表示します。Latin-1などは対応しません。
Unicodeは4桁のUTF-16単位です。\uD83D\uDE00 は 😀、\u{1F600} は対象外。引用符や \n はそのままなのでJSON全体にはJSONパーサーを使用してください。
実務での落とし穴
- 通常の文字は保持し、不正なエスケープやUTF-8バイト列はエラーにします。入力に合う形式を選択してください。
\uXXXX: UTF-16;\xXX: UTF-8;&#x…;: Unicode.
参考資料
最終更新: 2026-10-11
よくある質問
- 絵文字が \uXXXX 二つになるのはなぜ?
- \uXXXX は UTF-16 コード単位です。BMP 外(多くの絵文字)はサロゲートペアになります。例: 😀 は \uD83D\uDE00(U+1F600)です。
- Unicode / Hex / HTML の違いは?
- Unicode は \uXXXX(UTF-16)、Hex は UTF-8 バイトごとの \xXX、HTML は 😀 などの 16 進数値実体です。 ログや言語に合わせて選んでください。
- 日本語ログの \u エスケープを読むには?
- Decode と Unicode(\uXXXX)を選び、エスケープ列を貼り付けます。Sample でハングル+絵文字の往復も確認できます。
- データはサーバーに送られますか?
- いいえ。変換はブラウザ内だけで実行されます。
- UTF-8のHexが途中で切れるとエラーになる理由は?
- Hexは連続したバイトをUTF-8として読みます。\xec\x95 のような途中の入力はエラーです。Latin-1ではありません。通常の文字や他形式はそのまま保持します。