Cookie の使用について.本サイトでは、基本機能の提供に必要な必須 Cookie を使用しています。さらに、同意いただいた場合に限り、アクセス解析 Cookie を利用して利用状況を把握し、サービス改善に役立てます。詳しくは .
このツールは使いやすかったですか?
フィードバックは改善に役立ちます
GB2312编码查询工具,输入汉字获取区位码、国标码、内码对照
複数の文字を一度に入力できます。対応するGB2312コードが順に表示されます。
検索する漢字またはGB2312文字を入力してください。
概要
解決できる課題、処理の仕組み、データの範囲を確認できます。
GB2312コード検索は、中国語の文字またはコードを入力し、対応する文字、区位コード、国標コード、機内コード、Unicodeコードポイントを一覧で照合するためのページです。「文字 → コード」と「コード → 文字」を切り替えられ、文字側では複数の漢字や記号をまとめて入力できます。旧データ、通信仕様、字形表の記載を読み解く際に、コードの種類を取り違えていないか確認できます。
GB/T 2312-1980は中国語文字を扱う標準です。区位コードは区番号と位番号をそれぞれ2桁の十進数で表した位置表記です。例として「啊」は区位コード 1601、国標コード 3021、機内コード B0A1、Unicodeは U+554A と表示されます。これらは同じ文字を異なる体系で示す値で、相互に同じ形式として扱うことはできません。
区位コードの先頭2桁が区、後ろ2桁が位です。国標コードは区と位をそれぞれ16進数にして 0x20 を加えた2バイト、機内コードはその各バイトに 0x80 を加えた表記として整理できます。「啊」では区16が16進数10なので国標コードの先頭は30、位01は21となり、3021。各バイトに80を加えると B0A1 です。
国標コードの各バイト = 区・位の値 + 0x20機内コードの各バイト = 国標コードの各バイト + 0x80
結果表には区分も表示されます。01〜09区は記号区、16〜55区は第一級漢字、56〜87区は第二級漢字として表示されます。区分とUnicode欄を合わせて見ると、対象文字と数値の対応を確認しやすくなります。
この照合ではブラウザーの文字デコード規則を利用し、入力されたコードを文字に対応付けます。WHATWG Encoding Standardでは、ウェブ上の gb2312 ラベルはGBKデコーダーに対応します。そのため、ここで表示される文字の範囲はGB/T 2312の割当範囲そのものと常に一致するとは限りません。結果は入力コードと表示文字の対応を確かめる手掛かりとして使い、厳密な規格適合性の判定とは分けてください。
使い方
手順に沿って操作し、例を使って入力と結果を確認します。
漢字や記号を入力するモードです。モードを切り替えると入力欄は空になるため、先に検索方向を決めます。
一文字だけでなく複数文字も入力できます。例として「啊中国,」を入れると、対応する文字が入力順に一覧化されます。同じ文字は最初の一件だけが残り、対応結果がない文字は結果行になりません。
文字、区位コード、国標コード、機内コード、Unicode、区分の列を見比べます。文字の横にあるコピー操作が対象にするのは文字そのものです。
「コード → 文字」では、4桁の十進数は区位コードとして解釈されます。たとえば 1601 は「啊」です。4桁の16進数は機内コードまたは国標コードとして照合できます。複数の値は空白、改行、カンマ、読点、セミコロンで区切れます。1601 B0A1 2590 のように入力すると、同じ機内コードに解決される重複結果は一行にまとめられます。
活用例
仕事や日常の流れの中での活用方法を紹介します。
保守担当者がログや保存済みテキストにあるコードを調べ、対応する文字を確認します。結果を元データの文字コード宣言やバイト列と突き合わせることで、調査対象の値を整理できます。
学習者が区位コードから国標コード、機内コードへの変換例を手計算し、代表文字の結果と照合します。コード体系の差を理解するための確認用として使えます。
運用担当者が機器資料に記された4桁の16進数を入力し、表示候補を確認します。コードの種類が仕様書で定義されている場合は、その定義と結果表の列を合わせて見ます。
Q&A
よくある疑問や迷いやすい点をまとめて確認できます。
4桁が数字だけの場合は区位コードとして扱われます。国標コードが 3021 の「啊」をこの欄から引く場合、16進数として明示される入力が必要ですが、数字のみでは区位コードとの区別ができません。区位コードの 1601 または機内コードの B0A1 を使う方法が確実です。
この逆引き欄は区位コードとGB2312関連の4桁16進コードを対象とし、Unicodeコードポイントを検索する機能ではありません。U+554A は結果表に表示されるUnicode値として確認してください。
文字検索は対応するコードに引き当たる文字だけを表示し、該当しない入力を個別のエラー行にはしません。別の文字コード規格にある字を調べる場合は、その規格に対応した資料と照合してください。
コードが4桁か、複数値の区切りが空白・カンマ・読点・セミコロンのいずれかを確認します。十進数は区位コードとして解釈され、16進数はコード範囲とデコード結果が有効な場合に表示されます。10〜15区は結果から除外されます。
注意
利用範囲、結果の制限、必要な注意点を事前に確認します。
このページは入力値を文字とコードの対応表として照合する用途です。ファイル全体の文字コードを自動判定したり、実データのバイト列やプロトコル適合性を検査したりするものではありません。
関連
関連ツール、特集、利用可能なAPIを探せます。