ASCII 文字検索表
ASCII 文字を検索・比較できる総合ツールです。0~255 の全コードを網羅し、10 進数、16 進数、2 進数、Unicode からリアルタイム検索できます。テキスト変換、お気に入り、最近の検索履歴も内蔵しています。
一致する文字がありません
ASCII とは何ですか?
ASCII(American Standard Code for Information Interchange)は、コンピューターで最も基本的な文字エンコード規格です。7 bit で 128 文字を表し、英字(A-Z、a-z)、数字(0-9)、句読点、制御文字を含みます。
ASCII encoding は 1963 年に初めて公開され、もともとは電信通信向けに設計されました。単純で汎用性が高いため、現在でも Unicode や UTF-8 など現代のテキスト encoding の基礎となっています。
要点: ASCII が 7 bit(0–127)のみを使うのは、初期通信回線では一度に 7 bit のデータしか送れず、8 bit 目が parity に使われることが多かったためです。
ASCII と Unicode の違い
| 項目を比較 | ASCII | Unicode |
|---|---|---|
| ビット数 | 7 bits | 可変(UTF-8、UTF-16、UTF-32) |
| 文字数 | 128(基本) | 149,000 以上 |
| 対応言語 | 英語のみ | 世界中のすべての言語 + 絵文字 |
| 互換性 | — | ASCII と前方互換(UTF-8) |
| リリース年 | 1963 | 1991 |
| 利用シナリオ | 旧式システム、組み込み、英語のみ | Web、最新アプリ、多言語 |
LF、CR、CRLF の違い
3 つとも「改行」を表す記号ですが、OS ごとに異なる convention が使われます:
| 記号 | 数値 | システムを使用 | 説明 |
|---|---|---|---|
| LF | 10 (0x0A) | Linux / macOS | Line Feed:カーソルを 1 行下へ移動します |
| CR | 13(0x0D) | Classic Mac(OS 9) | Carriage Return。cursor を line の先頭へ戻します |
| CRLF | 13 10(0x0D 0x0A) | Windows | キャリッジリターン + ラインフィードの組み合わせ |
Git は次の場所にあります .gitattributes 異なる platform 間で改行コードを自動変換する設定です。
なぜ does ASCII only have 128 characters のですか?
ASCII は 7-bit encoding を使い、2⁷ = 128 なので最大 128 character しか表現できません。理由は次のとおりです:
- 過去の制約: 1960 年代の通信機器では 7-bit transmission が使われ、8 bit 目を parity bit として基本的な error detection に利用していました。
- コスト上の考慮事項: 当時はメモリや記憶容量が非常に高価で、英字、数字、基本記号を表すには 7 ビットで十分でした。
- 設計目標: ASCII は英語向けに設計されており、他言語の character を収容する必要がありませんでした。
その後、128 文字では不足する問題を解決するため Extended ASCII(128–255)が登場し、最終的に Unicode standard へ発展しました。
ASCII FAQ
Extended ASCII とは何ですか?
ASCII と UTF-8 にはどのような関係がありますか?
文字の ASCII 値を調べるには?
1. プログラミング言語:
'A'.charCodeAt(0)(JavaScript)または ord('A')(Python)2. このツールの「ASCII Converter」に text を直接入力すると、対応する decimal value を確認できます。
3. このツールの検索ボックスに文字を入力すると、対応するすべてのエンコーディング情報を確認できます。
ASCII の control character は何に使われますか?
- NUL(0):C 言語の文字列終端文字
- BEL (7): 端末がビープ音を鳴らします
- BS (8): Backspace キー
- TAB(9):Tab 文字(インデント)
- LF (10):Unix/Linux 改行
- CR (13):入力
- ESC (27): Escape キー。端末制御シーケンスでよく使用されます
- DEL (127): Delete キー
これらの文字は現在でもネットワークプロトコル、シリアル通信、プリンター制御などの分野で使われています。
Code Page とは何ですか?
- CP437: IBM PC native code page(frame-drawing character を含む)
- Windows-1252:西ヨーロッパ(ISO-8859-1 の代替)
- CP850:Latin-1(DOS 用)
Unicode が普及する前、Code Page は複数 language を扱う主要な方法でした。
the NUL character (0x00) とは何ですか?
なぜ 'A' は 65 なのですか?単なる偶然ですか?
- 数字(0–9): 文字コード 48~57(0x30~0x39)は数字 0~9 に対応し、プログラムでは 48 を引くだけで数値へ素早く変換できます。
- 大文字(A–Z):エンコード 65–90(0x41–0x5A)
- 小文字(a–z):エンコード 97–122(0x61–0x7A)
英大文字と小文字のコード値には 32(0x20)の固定差があるため、ASCII の大文字・小文字変換はビット演算だけでも実現できます。lowercase = uppercase | 0x20、uppercase = lowercase & ~0x20 です。メモリや CPU 資源が非常に限られていた初期のコンピューターでは、この設計が特に有効でした。