文字コード・改行
記事一覧
つまずきを減らす!テキストエディタの文字コード確認、BOMと自動判定で文字コード確認
テキストエディタで文字コード確認をするときは、BOMの有無、読込み時に判定された文字コード、保存時に自分が選ぶ文字コードを別々に記録してください。この三つは似ていますが、同じ情報ではありません。 今回Rune Studi […]置換ミスを防ぐ!テキストエディタの改行コード置換、改行文字そのものを置換
テキストエディタで改行コードを置換するときは、画面に見える段落記号を一つずつ検索するのではなく、複製したファイル全体の改行方式をCRLFからLFへ変更し、保存後に行数と改行数を数え直すのが安全です。今回Rune Stud […]
入稿後の手戻りを防ぐ!テキストエディタのUTF-8変換、変換不能文字を修正
Shift_JIS原稿をUTF-8へ変換するときは、変換不能文字を先に解消し、UTF-8の別名版を開き直して本文・文字数・改行を照合します。今回の標本は要求1,400字に対して実測1,399字、改行はCRLFでした。😀が […]
テキストエディタのShift-JIS、違いがひと目で分かる!Shift-JISで表現できない文字を発見
Shift_JISで表現できない文字を保存前に見つけるには、「機種依存文字」という大きな分類ではなく、実際の文字と位置を一件ずつ検査します。今回の1,000字標本では、インデックス23の😀と24の🚀の2件が変換不能でした […]
見落としを防ぐ!テキストエディタのCR・LF表示、CR・LF・CRLFの違いを確認
テキストエディタでCR・LFを表示・確認するときは、記号名だけで判断せず、同じ本文をCR、LF、CRLFで保存してバイト数を比べます。今回の20行標本では、CR版がCR 20/LF 0、LF版がCR 0/LF 20、CR […]
作業を迷わず進める!テキストエディタのBOM、UTF-8 BOMあり・なしの判定
テキストエディタのBOM判定で今回答えるのは、「BOMの一般的な見分け方」ではなく、先頭バイトと検出結果を同じファイルの証拠として採用できるかです。先頭が EF BB BF で検出結果がUTF-8 (BOM)ならBOMあ […]
違いがひと目で分かる!テキストエディタのエンコード、エンコードを切り替え
テキストエディタでエンコードを切り替えるときは、「読み方を変える」「保存形式を変える」を別の操作として扱います。候補を切り替えて正しい本文を見つけ、その後で別名保存します。原本への上書きを避けるだけで、試行錯誤のリスクは […]
見落としを防ぐ!UTF-16対応テキストエディタ、UTF-16LEとBEを開く
UTF-16LEとUTF-16BEを開くときは、見た目で推測せず、先頭のBOM、エディタが示す文字コード、既知の日本語文の三つを照合します。LEとBEはバイトの並び順が異なるため、反対に読むと日本語はほぼ判別できなくなり […]
作業を迷わず進める!テキストエディタの文字化け、正しい文字コードで開き直す
文字化けを見つけたら、最初にすべきことは保存ではありません。同じファイルのバイトを保ったまま、別の文字コードで開き直し、既知の文字が正しく戻るかを確かめます。上書きは、正しい読み方を特定してからです。 「読み間違い」か「 […]
事故を持ち越さない!テキストエディタの文字コード変換、変換不能文字を赤表示して修正
赤く示された変換不能文字は、一括置換で消すのではなく、文脈を読んで一件ずつ修正します。その後、候補が0件になったことと、別名保存したファイルが正しく開き直せることを確かめます。この記事の主役は「どう発見するか」ではなく、 […]