UTF-8変換・デコードツール

日本語テキストをUTF-8の16進数バイト列へ変換し、\xE3 や %E3 形式のUTF-8コードを文字にデコードできます。文字コード変換や文字化け確認に使える無料オンラインツールです。

UTF-8 変換と文字コード確認

テキストをUTF-8バイト列にエンコードし、UTF-8の16進数、\xXX、%XX、バイトストリームを読みやすい文字へデコードします。日本語の文字コード変換、APIログの確認、文字化け調査に使いやすいオンラインツールです。

🔄
複数のUTF-8表記に対応\xXX、%XX、URLエンコード、連続した16進数バイト、文字ごとの対応表を切り替えられます
📊
日本語の文字コード確認ひらがな、カタカナ、漢字、記号、EmojiがUTF-8で何バイトになるか確認できます
🔒
ローカル処理すべての変換はブラウザで完結、サーバーにデータを送信しない
🌐
全文字対応日本語、中国語、韓国語、Emojiを含むUnicode文字のUTF-8エンコードとデコードに対応

使い方

1

テキストを入力

左側の入力欄に日本語テキスト、UTF-8コード、16進数バイト列を入力

2

形式を選択

ドロップダウンから \xXX、%XX、URLエンコード、バイトストリームなどの形式を選択

3

変換をクリック

「UTF-8にエンコード」または「UTF-8をデコード」をクリックして文字コード変換を実行

4

結果をコピー

右側の出力欄に結果が表示され、コピー可能

UTF-8 変換でよくある確認ポイント

\x形式、%形式、16進数の違い

ネットワークログには \xE4 形式、%E4 の URL エンコード、純粋な16進数が混在することがあります。デコード前に一致する出力形式を選ぶと、バイト列を正しく正規化できます。

奇数長または不完全なバイト

UTF-8 のデコードには完全なバイト列が必要です。16進文字列が奇数長だったり、マルチバイト文字が途中で切れていたりすると、置換文字や文字化けが出ることがあります。

Emoji と4バイト文字

Emoji、まれな CJK 文字、多くの記号は UTF-8 で4バイトを使います。1つの見える文字が4バイトになるのは正常で、エラーではありません。

日本語の文字化けの原因

デコード後も読めない場合、元データは UTF-8 ではなく Shift_JIS、EUC-JP、GBK、Big5 など別の文字コードで保存されている可能性があります。

よくある質問

UTF-8 とは何ですか?

UTF-8 は Unicode 用の可変長文字エンコーディングです。1〜4 バイトを使って文字を表現するため、ASCII 文字のエンコードに効率的でありながら、すべての Unicode 文字に対応しています。

このツールはどのようにテキストを UTF-8 に変換しますか?

このツールは、ブラウザに組み込まれている TextEncoder を使ってテキストを UTF-8 にエンコードします。各文字は Unicode のコードポイントに基づいて 1 つ以上のバイトに変換され、その後、16 進数のエスケープシーケンス(例:\xE3\x81\x82 は「あ」を表す)にフォーマットされます。

このツールはどのように UTF-8 をテキストに変換しますか?

このツールは、入力から \x プレフィックスを削除し、残りの 16 進数値をバイトとして解析します。これらのバイトは、ブラウザの TextDecoder を使用してテキストにデコードされ、UTF-8 のエンコード規則に基づいて元の文字が再構築されます。

なぜ UTF-8 は広く使われているのですか?

UTF-8 は ASCII との後方互換性があり、英語テキストのエンコードに効率的で、すべての Unicode 文字をサポートしているため広く使われています。ウェブページや多くのシステムのデフォルトエンコーディングであり、異なるプラットフォーム間でのテキストの一貫性を保証します。

UTF-8 エンコーディングの原理は何ですか?

UTF-8 エンコーディングは、Unicode のコードポイントをバイト列に変換することで機能します:

  • コードポイント U+0000~U+007F は 1 バイトでエンコードされます(ASCII と互換)。
  • コードポイント U+0080~U+07FF は 2 バイトでエンコードされます。
  • コードポイント U+0800~U+FFFF は 3 バイトでエンコードされます。
  • コードポイント U+10000~U+10FFFF は 4 バイトでエンコードされます。

複数バイトからなるシーケンスでは、各バイトはシーケンス内での役割を示す特定のビットパターンで始まり、UTF-8 は自己同期性とエラー耐性を持ちます。

さまざまなプログラミング言語で UTF-8 変換を実装するには?

以下は、さまざまなプログラミング言語で文字列を UTF-8 バイト列にエンコードしたり、UTF-8 バイト列を文字列にデコードしたりする例です:

Go

utf8Bytes := []byte(text)
decodedText := string(utf8Bytes)

Java

byte[] bytes = text.getBytes(StandardCharsets.UTF_8);
String str = new String(bytes, StandardCharsets.UTF_8);

Python

utf8_bytes = text.encode("utf-8")
decoded_text = utf8_bytes.decode("utf-8")

JavaScript

const bytes = new TextEncoder().encode(text);
const str = new TextDecoder().decode(bytes);

UTF-8 変換ツールはどんな場面で使いますか?

UTF-8 変換ツールは、APIレスポンス、URLエンコード済み文字列、ログ、データベース保存値、CSVやテキストファイルの文字化け確認などで役立ちます。日本語の文字コード変換を確認したいときに、UTF-8エンコードとUTF-8デコードを素早く試せます。

オンラインUTF-8変換ツールの利点は何ですか?

オンラインUTF-8変換ツールはソフトウェアのインストール不要で、ブラウザさえあれば使用できます。素早いデバッグ、データ検証、異なるシステム間のテキストエンコーディング問題の対応に便利です。

日本語文字をUTF-8に変換するにはどうすればよいですか?

入力欄に日本語を入力し、「UTF-8にエンコード」をクリックしてください。各文字はUTF-8の16進数表記に変換されます。例えば「あ」は「\xE3\x81\x82」に変換されます。

このUTF-8変換ツールは無料のオンラインツールですか?

はい、このUTF-8変換ツールは完全に無料で、ブラウザ上でオンラインで動作します。登録やダウンロードは不要です。すべての処理はブラウザ内でローカルに行われ、プライバシーが保護されます。

このツールで絵文字を変換できますか?

はい!このツールは絵文字を含むすべてのUnicode文字に完全対応しています。例えば、😊 はUTF-8の16進数バイト \xF0\x9F\x98\x8A に変換されます。

文字の UTF-8 エンコーディングを調べるには?

入力欄に任意の文字(日本語、漢字、記号、Emoji など)を入力し、出力形式を選んで「UTF-8 にエンコード」をクリックすると、その文字の UTF-8 エンコード値がわかります。例えば「あ」と入力すると、UTF-8 エンコード \xE3\x81\x82(3 バイト)が得られます。複数文字の一括検索にも対応しています。

UTF-8 エンコーディングのルールとバイト対応表

UTF-8 は可変長エンコーディングで、1〜4 バイトで1文字を表現します。以下は UTF-8 エンコーディングテーブルとバイト対応関係の詳細です:

Unicode 範囲(16進数)UTF-8 バイナリ形式バイト数
0000 0000 - 0000 007F0xxxxxxx1バイト(ASCII)
0000 0080 - 0000 07FF110xxxxx 10xxxxxx2バイト
0000 0800 - 0000 FFFF1110xxxx 10xxxxxx 10xxxxxx3バイト(よく使う漢字)
0001 0000 - 0010 FFFF11110xxx 10xxxxxx 10xxxxxx 10xxxxxx4バイト(Emoji など)