Tutorial

PDFの機密情報を正しく墨消しする方法

PDFの黒塗りは、黒い四角を重ねるだけでは不十分です。見せかけの墨消しに潜む情報漏えいのリスク、LuraPDFを使った正しい墨消しの手順、あわせて削除すべきメタデータ、そして文字が本当に消えたかを確かめる方法まで、わかりやすく解説します。

LuraPDF Team
LuraPDF Team

編集・技術チーム · 2026年5月3日 · 12分読む

PDFの墨消し失敗は、実際に深刻な被害をもたらしてきた。2011年、ある法律事務所が公開裁判の訴訟資料に墨消し未済のドキュメントを誤って提出した——「墨消し済み」のテキストは黒いボックスで覆われていたが、PDFのデータにはテキストがそのまま残っており、簡単に抽出できる状態だった。2019年にはNSAが公開した墨消し済み報告書で、黒く塗りつぶされた箇所をハイライト・コピーして平文で読めることが判明した。

これらの失敗には共通の原因がある。墨消しが視覚的なものに過ぎず、構造的ではなかったことだ。黒いボックスは墨消しではない。このガイドでは、その違いを説明し、正しい墨消しの方法を示し、墨消しによって実際に元のコンテンツが削除されているかを確認する方法を解説する。

黒いボックス問題

PDFページには、複数のコンテンツレイヤーが重なって存在できる。基本的な注釈ツールでテキストの上に黒い矩形を描画すると、次の状態になる。

  1. 元のテキストが検索・選択・コピー可能なデータとしてPDFに残ったまま
  2. その上に黒い矩形の注釈が重なった状態

テキストは視覚的には隠れているが、構造的には存在している。以下の操作を行った人には誰でも「墨消し済み」のコンテンツが見えてしまう。

  • 全選択してテキストをコピーする
  • テキスト検索を実行する
  • 注釈を削除または非表示にする
  • PDFテキスト抽出ツールでファイルを処理する

これは墨消しではない。隠蔽だ。そして隠蔽は失敗する。

真の墨消しは、PDFのデータ構造から元のコンテンツを削除しなければならない。視覚的に隠すだけでは不十分だ。

適切な墨消しの仕組み

適切な墨消しには3つのステップがある。

  1. 墨消し対象のコンテンツをマーク: 削除するテキストや領域を特定する
  2. 墨消しを焼き込む: マークされたコンテンツを不透明なマーク(通常は黒)で置き換え、PDFの構造から元データを完全に削除する
  3. サニタイズ: メタデータ、隠しテキストレイヤー、墨消し情報を含む可能性のあるその他の非表示データを削除する

ステップ2が最も重要だ。墨消しを焼き込んだ後、テキストが存在していたPDFのページコンテンツストリームは、単に覆われるのではなく上書きされなければならない。

LuraPDFでPDFを墨消しする方法

LuraPDFのRedact PDFツールは構造的な墨消しを実行する——元のコンテンツを覆うのではなく、削除する。

ステップ1:アップロードとコンテンツの特定

LuraPDF Redact PDFツールを開き、ドキュメントをアップロードする。機密コンテンツを含むページを確認する。

ステップ2:墨消しエリアのマーク

墨消しが必要なコンテンツの上に矩形を描画する。以下の操作が可能だ。

  • ドラッグしてテキスト領域を選択する
  • 画像やグラフィック要素の上にボックスを描く
  • 適用前に同一ページ上の複数の箇所をマークする

ステップ3:墨消しの適用

「Apply Redactions」をクリックする。これにより焼き込みプロセスが実行される。マークされた各領域の下にあるコンテンツがPDFデータから完全に削除され、その場所に黒い塗りつぶしが描画される。

ステップ4:確認

ダウンロード後、墨消し済みPDFを開き、以下を試みる。

  • 墨消しされた領域のテキストを選択してコピーする(何も返ってこないはずだ)
  • 墨消しした単語を検索する(何もヒットしないはずだ)

この確認ステップは、法的・医療的・機密性の高いコンテンツを含むドキュメントを共有する前に欠かせない。

LuraPDFが墨消しする対象

  • テキスト: PDFのコンテンツストリームから抽出・削除される
  • 画像: マークされた領域の画像データが切り取られる
  • 注釈: 墨消しされた領域内の注釈(コメント、ハイライト)が削除される

併せて削除すべきもの:メタデータ

表示コンテンツの墨消し後、メタデータも忘れずに確認する。PDFにはしばしば以下が含まれる。

  • 作成者名
  • 組織名
  • 作成アプリケーション
  • 改訂履歴と編集日時
  • 他のセクションのコメントや注釈

墨消し後にLuraPDF Remove Metadataを使用して、これらの情報を削除する。メタデータ自体が機密情報である場合(例:作成者名が機密情報源の身元を明かしてしまう場合)は特に重要だ。

高リスクな墨消しのシナリオ

法的・医療的・国家安全保障に関するドキュメントでは、追加のステップを検討する必要がある。

裁判所への提出書類: 多くの裁判所は特定の墨消し形式を要求する。裁判所の文書管理ガイドラインを確認すること。墨消し色を(グレーや白ではなく)黒に指定している場合もある。

医療記録: HIPAAの対象ドキュメントでは、18種類の識別情報をすべて削除する必要がある。日付、州レベル以下の地理データ、電話番号、メールアドレス、URL、社会保障番号、医療記録番号が含まれる。

政府文書(FOIA): 米国の情報公開法に基づく墨消しは、特定の法的基準を満たさなければならない。過剰な墨消し(over-redaction)は、墨消し不足と同様に問題となりうる。

弁護士・依頼人間の秘匿特権文書: 業務成果物特権に基づく墨消しは、提出前に弁護士によるレビューを受けるべきだ。

墨消しの確認方法

墨消し後、送付前に以下を実施する。

  1. テキストビューアーまたはPDFリーダーで墨消し済みPDFを開く
  2. 「全選択」+「コピー」でテキストエディタに貼り付け——墨消ししたテキストが表示されないことを確認する
  3. 墨消しを意図した特定の単語を検索する
  4. ファイルのプロパティを開き、メタデータがクリーンであることを確認する
  5. 可能であれば、同僚に墨消しされたコンテンツへのアクセスを試みてもらう

最大限の確実性を得るには、墨消し済みPDFを新しいPDFとして印刷すること(OSの印刷先をPDFに指定する機能を使用)を検討する。これによりドキュメント全体が純粋な視覚コンテンツに「フラット化」され、元のデータ構造に残存するいかなるデータも排除される。

よくある質問

テキストを覆うためにハイライトを使用したのですが、それは正しい墨消しですか? いいえ。ハイライト注釈は見た目こそ黒いボックスと同じだが、テキストはPDFデータに残ったままだ。本物の墨消しは、元のコンテンツを削除する構造的な墨消しだけだ。

スキャンされたPDFも墨消しできますか? できるが、方法が異なる。スキャンされたPDFは画像だ。画像の領域の上に描画すれば、そのピクセルは実質的に永久に削除される——心配すべき元のテキストデータは存在しない。LuraPDFの墨消しツールは、画像ベースのPDFに対してこの処理を正しく実行する。

パスワードで保護されたPDFは墨消しできますか? まずUnlock PDFでパスワードを解除してから、墨消しを行う。

適用後に墨消しを元に戻せますか? いいえ。墨消しは設計上、永久かつ不可逆だ。墨消しを行う前に、未墨消しの原本のコピーを安全なストレージに保存しておくこと。

白い墨消し(白いボックス)は黒いものと同じですか? 構造的には同じだ——PDFデータからコンテンツが削除されていれば、置換フィルの色は見た目の問題に過ぎない。ただし、慣例および多くの規制要件では黒が指定されている。白いボックスは、墨消されたコンテンツではなく欠落したコンテンツのように見えるため、混乱を招く可能性がある。

適切に墨消しされたドキュメントと「覆われた」ドキュメントの違いは目には見えない——しかし、視覚的なレイヤーを超えて確認する者には完全に見えてしまう。リスクが高い場合は必ず確認すること。迷ったときは、ボックスではなく適切な構造的墨消しを使用すること。

著者について

LuraPDF Team
LuraPDF Team

編集・技術チーム · 2026年5月3日 · 12分読む

LuraPDFチームは、ドキュメント処理のエキスパート、ソフトウェアエンジニア、テクニカルライターで構成され、PDF編集を無料、プライベート、かつ誰もが使いやすいものにすることを目指しています。