HTML からプレーンテキストへ
DOM ラウンドトリップなしで、専用に作られた小さなパーサーで入力を一度走査 — テキストコンテンツのみを発行。`<script>`、`<style>`、`<iframe>` などはその内容と一緒に破棄;ブロックレベルのタグ(`<p>`、`<h1>`、`<li>`、…)は改行になる;`&` や `©` のようなエンティティは元の文字にデコード。CMS やメールからリッチテキストをコピーして Markdown ファイル、スプレッドシート、ターミナル用のプレーンコンテンツが必要なときに便利。
—
プレーンテキスト (62 文字)
Hello, world! This is a link & some text. One Two End.
タグの除去はサニタイザーではない — 敵対的な HTML を信頼してはならず、再レンダリングするなら DOMPurify を通すこと。
使い方
- 入力に HTML スニペットを貼り付け。
- オプションを好みでトグル — ブロックレベルの改行を保持、空白の連続を圧縮、エンティティをデコード。
- 出力をコピー。文字数が表示されるのでフィールド長制限を確認可能。
よくある質問
- なぜブラウザの `innerText` を使わない?
- `innerText` は動くが、CSS レイアウトを引き込む(ドキュメントのスタイルシートに基づいて変わる)し、DOM を構築してからでないと実行されない。このツールは小さな純粋パーサー — スタイルに関係なく、同じ入力に対して常に同じ出力を生成する。
- `preserveBreaks` のオン / オフの違いは?
- オンにすると、ブロックレベルのタグ(`<p>`、`<h1>`、`<li>`、`<br>`、…)が出力で改行になる。オフでは入力全体が 1 行に圧縮される — CSV セルや 1 行タイトルにテキストが必要なときに便利。
- 入力はサニタイズされる?
- すべてのタグが取り除かれる — 出力に HTML はない — がパーサーは意図的に最小限。レンダリングする予定の信頼できない HTML には、strip ステップに頼らず DOMPurify のような本物のサニタイザーを通すこと。
関連ツール
Markdown → プレーンテキスト
Markdown の書式を全て取り除き、読める平文だけを残す — 概要・要約・メール・正確な文字数に有用。
変換 0 0
画像 EXIF 削除
写真をドロップで EXIF・GPS・その他メタデータを削除したクリーンなコピーをダウンロード。すべてブラウザ内処理、アップロードなし。
画像 0 0
改行を削除
折り返された行をつなぎ直してきれいな文章に — PDF やメールからコピーしたときの強制改行を取り除きつつ、本来の段落は保持します。
テキスト 0 0
Unicode 正規化 (NFC, NFD, NFKC, NFKD)
テキストを NFC・NFD・NFKC・NFKD に正規化し、必要なら発音区別符号を除去(café → cafe)、4 形式のコードポイント・バイト数を比較 — ブラウザ内で。
テキスト 0 0
Markdown → HTML 変換
Markdown を生 HTML に変換 — メール、CMS、レンダリングでは足りない場面のためにソースをコピー。
テキスト 0 0
大文字・小文字変換
大文字・小文字・Title・camelCase・snake_case などに変換。
テキスト 0 0