UTF-8変換・デコードツール
日本語テキストをUTF-8の16進数バイト列へ変換し、\xE3 や %E3 形式のUTF-8コードを文字にデコードできます。文字コード変換や文字化け確認に使える無料オンラインツールです。
UTF-8 変換と文字コード確認
テキストをUTF-8バイト列にエンコードし、UTF-8の16進数、\xXX、%XX、バイトストリームを読みやすい文字へデコードします。日本語の文字コード変換、APIログの確認、文字化け調査に使いやすいオンラインツールです。
使い方
テキストを入力
左側の入力欄に日本語テキスト、UTF-8コード、16進数バイト列を入力
形式を選択
ドロップダウンから \xXX、%XX、URLエンコード、バイトストリームなどの形式を選択
変換をクリック
「UTF-8にエンコード」または「UTF-8をデコード」をクリックして文字コード変換を実行
結果をコピー
右側の出力欄に結果が表示され、コピー可能
UTF-8 変換でよくある確認ポイント
\x形式、%形式、16進数の違い
ネットワークログには \xE4 形式、%E4 の URL エンコード、純粋な16進数が混在することがあります。デコード前に一致する出力形式を選ぶと、バイト列を正しく正規化できます。
奇数長または不完全なバイト
UTF-8 のデコードには完全なバイト列が必要です。16進文字列が奇数長だったり、マルチバイト文字が途中で切れていたりすると、置換文字や文字化けが出ることがあります。
Emoji と4バイト文字
Emoji、まれな CJK 文字、多くの記号は UTF-8 で4バイトを使います。1つの見える文字が4バイトになるのは正常で、エラーではありません。
日本語の文字化けの原因
デコード後も読めない場合、元データは UTF-8 ではなく Shift_JIS、EUC-JP、GBK、Big5 など別の文字コードで保存されている可能性があります。
よくある質問
UTF-8 とは何ですか?
UTF-8 は Unicode 用の可変長文字エンコーディングです。1〜4 バイトを使って文字を表現するため、ASCII 文字のエンコードに効率的でありながら、すべての Unicode 文字に対応しています。
このツールはどのようにテキストを UTF-8 に変換しますか?
このツールは、ブラウザに組み込まれている TextEncoder を使ってテキストを UTF-8 にエンコードします。各文字は Unicode のコードポイントに基づいて 1 つ以上のバイトに変換され、その後、16 進数のエスケープシーケンス(例:\xE3\x81\x82 は「あ」を表す)にフォーマットされます。
このツールはどのように UTF-8 をテキストに変換しますか?
このツールは、入力から \x プレフィックスを削除し、残りの 16 進数値をバイトとして解析します。これらのバイトは、ブラウザの TextDecoder を使用してテキストにデコードされ、UTF-8 のエンコード規則に基づいて元の文字が再構築されます。
なぜ UTF-8 は広く使われているのですか?
UTF-8 は ASCII との後方互換性があり、英語テキストのエンコードに効率的で、すべての Unicode 文字をサポートしているため広く使われています。ウェブページや多くのシステムのデフォルトエンコーディングであり、異なるプラットフォーム間でのテキストの一貫性を保証します。
UTF-8 エンコーディングの原理は何ですか?
UTF-8 エンコーディングは、Unicode のコードポイントをバイト列に変換することで機能します:
- コードポイント U+0000~U+007F は 1 バイトでエンコードされます(ASCII と互換)。
- コードポイント U+0080~U+07FF は 2 バイトでエンコードされます。
- コードポイント U+0800~U+FFFF は 3 バイトでエンコードされます。
- コードポイント U+10000~U+10FFFF は 4 バイトでエンコードされます。
複数バイトからなるシーケンスでは、各バイトはシーケンス内での役割を示す特定のビットパターンで始まり、UTF-8 は自己同期性とエラー耐性を持ちます。
さまざまなプログラミング言語で UTF-8 変換を実装するには?
以下は、さまざまなプログラミング言語で文字列を UTF-8 バイト列にエンコードしたり、UTF-8 バイト列を文字列にデコードしたりする例です:
Go
utf8Bytes := []byte(text)
decodedText := string(utf8Bytes)Java
byte[] bytes = text.getBytes(StandardCharsets.UTF_8);
String str = new String(bytes, StandardCharsets.UTF_8);Python
utf8_bytes = text.encode("utf-8")
decoded_text = utf8_bytes.decode("utf-8")JavaScript
const bytes = new TextEncoder().encode(text);
const str = new TextDecoder().decode(bytes);UTF-8 変換ツールはどんな場面で使いますか?
UTF-8 変換ツールは、APIレスポンス、URLエンコード済み文字列、ログ、データベース保存値、CSVやテキストファイルの文字化け確認などで役立ちます。日本語の文字コード変換を確認したいときに、UTF-8エンコードとUTF-8デコードを素早く試せます。
オンラインUTF-8変換ツールの利点は何ですか?
オンラインUTF-8変換ツールはソフトウェアのインストール不要で、ブラウザさえあれば使用できます。素早いデバッグ、データ検証、異なるシステム間のテキストエンコーディング問題の対応に便利です。
日本語文字をUTF-8に変換するにはどうすればよいですか?
入力欄に日本語を入力し、「UTF-8にエンコード」をクリックしてください。各文字はUTF-8の16進数表記に変換されます。例えば「あ」は「\xE3\x81\x82」に変換されます。
このUTF-8変換ツールは無料のオンラインツールですか?
はい、このUTF-8変換ツールは完全に無料で、ブラウザ上でオンラインで動作します。登録やダウンロードは不要です。すべての処理はブラウザ内でローカルに行われ、プライバシーが保護されます。
このツールで絵文字を変換できますか?
はい!このツールは絵文字を含むすべてのUnicode文字に完全対応しています。例えば、😊 はUTF-8の16進数バイト \xF0\x9F\x98\x8A に変換されます。
文字の UTF-8 エンコーディングを調べるには?
入力欄に任意の文字(日本語、漢字、記号、Emoji など)を入力し、出力形式を選んで「UTF-8 にエンコード」をクリックすると、その文字の UTF-8 エンコード値がわかります。例えば「あ」と入力すると、UTF-8 エンコード \xE3\x81\x82(3 バイト)が得られます。複数文字の一括検索にも対応しています。
UTF-8 エンコーディングのルールとバイト対応表
UTF-8 は可変長エンコーディングで、1〜4 バイトで1文字を表現します。以下は UTF-8 エンコーディングテーブルとバイト対応関係の詳細です:
| Unicode 範囲(16進数) | UTF-8 バイナリ形式 | バイト数 |
|---|---|---|
0000 0000 - 0000 007F | 0xxxxxxx | 1バイト(ASCII) |
0000 0080 - 0000 07FF | 110xxxxx 10xxxxxx | 2バイト |
0000 0800 - 0000 FFFF | 1110xxxx 10xxxxxx 10xxxxxx | 3バイト(よく使う漢字) |
0001 0000 - 0010 FFFF | 11110xxx 10xxxxxx 10xxxxxx 10xxxxxx | 4バイト(Emoji など) |