PDF として保存したい記事、レシピ、チュートリアル、またはリファレンス ページを見つけました。 Ctrl+P を押して [PDF として保存] を選択すると、結果は混乱します。 PDF には、ナビゲーション メニューを含む Web サイトのヘッダー、広告と関連投稿が含まれるサイドバー、著作権とソーシャル メディアのリンクが含まれるフッター、および数十のユーザー投稿が含まれるコメント セクションが含まれています。実際に必要なコンテンツは、各ページの中央 3 分の 1 のみを占めます。
Web から PDF 出力を Web ページ全体から必要なコンテンツ セクションのみに変換するには、ブラウザー リーダー モード、専用のクリーン プリント拡張機能、または手動のページ設定調整のいずれかを使用する必要があります。目標は、コンテンツのみを含み、読みやすいようにフォーマットされ、邪魔なインターフェイス要素のない PDF です。

ブラウザ リーダー モードを使用してクリーンな PDF 出力を行う
最新のブラウザには、Web ページからメイン コンテンツを抽出し、すっきりとした、邪魔にならない形式で表示するリーダー モードが含まれています。 Chrome、Edge、Firefox では、ブラウザがページ上の記事を検出すると、アドレス バーにリーダー モード アイコンが表示されます。アイコンをクリックしてリーダー モードに入り、リーダー モード ビューから PDF に印刷します。
リーダー モードでは、Web ページ全体を印刷するよりも大幅にきれいな PDF 出力が生成されます。リーダー モードでは、ナビゲーション、サイドバー、広告、コメントが削除され、記事のタイトル、テキスト、画像のみが残ります。テキストは、適切なサイズの読みやすいフォントでフォーマットされます。結果は、Web サイトのスクリーンショットではなく、ドキュメントのように見えます。
すべての Web ページがリーダー モードをトリガーするわけではありません。通常、レシピ サイト、チュートリアル ページ、長い記事はうまく機能します。製品ページ、フォーラム スレッド、およびインタラクティブな Web アプリケーションは通常、そうではありません。リーダー モードが利用できない場合は、以下で説明する代替方法のいずれかを使用してください。
Word から PDF への変換を試してみる
インストールは必要ありません。ブラウザで直接動作します。
Web ページから PDF へのクリーンな変換の代替方法
Print Friendly や PDF、Mercury Reader、Clearly などのブラウザ拡張機能は、組み込みのリーダー モードを超えた強化されたクリーン プリント機能を提供します。これらの拡張機能を使用すると、印刷前に特定のページ要素を削除したり、テキスト サイズを調整したり、複数ページの記事を単一のフロー ドキュメントに結合したりできます。
WukongPDF は、HTML として保存または PDF に印刷された Web ページ コンテンツを処理できる PDF エクスポート ツールを提供します。このプラットフォームは、PDF 出力をトリミング、クリーンアップ、および再フォーマットして、不要な要素を削除できます。
ブラウザ開発者ツールを使用した手動のアプローチでは、印刷前に特定の要素を削除できます。不要な要素を右クリックし、「検査」を選択して、HTML から要素ノードを削除します。不要な要素ごとに繰り返します。クリーンアップしたページを PDF に印刷します。このアプローチでは正確な制御が可能ですが、1 回限りの変換には時間がかかります。
WebページのPDF出力の印刷設定を構成する
Web ページを PDF に印刷する前に、ブラウザーの印刷ダイアログを開いて設定を調整します。コンテンツ領域を最大化するには、余白を [最小] または [なし] に設定します。ページでコンテンツの一部である背景色または画像が使用されている場合は、背景グラフィックを有効にします。ヘッダーとフッターを無効にして、保存された PDF に URL、日付、ページ番号がオーバーレイされるのを防ぎます。
PDF 形式 の最適化の場合は、コンテンツに一致する用紙サイズを選択してください。大きな画像を含む幅の広い記事には、横向きの方が効果がある場合があります。幅の狭いテキスト列の場合は、余白を調整して縦方向にすると効果がある場合があります。ブラウザーの印刷プレビューには、選択した用紙サイズにコンテンツがどのように収まるかが表示されます。
Web ページのコンテンツが複数の印刷ページにまたがり、改ページが不自然な場合は、最初にリーダー モードを使用します。これにより、テキストが 1 つの列にリフローされます。リフローされたテキストは、段落内の任意の位置ではなく、段落境界でページ全体に自然に分割されます。
保存した Web ページ PDF の整理
保存した PDF に記事のタイトルと日付を付けて名前を付けます。わかりやすいファイル名を付けると、ファイル システム内で PDF を見つけやすくなります。 Web ページの PDF は、他のドキュメントと混合せずに、専用のフォルダーに保存します。保存された記事のフォルダーは、個人の参照ライブラリになります。
多くの Web ページを PDF として保存する場合は、ソース URL を PDF メタデータまたは最初のページのコメントに追加します。更新を確認したり、他のユーザーとリンクを共有したりする必要がある場合は、URL を使用してライブ Web ページに戻ることができます。
一部の Web サイトでは、無限スクロールを使用して、読者が下にスクロールするときに追加のコンテンツを読み込みます。無限スクロール ページを印刷すると、現在ロードされているコンテンツのみがキャプチャされます。 PDF に印刷する前に、ページの一番下までスクロールしてすべてのコンテンツを読み込みます。
ペイウォールの記事は完全に印刷されない場合があります。表示されているプレビューは印刷されますが、ペイウォールの内側にある記事全体は印刷されません。購読契約を結んでいる場合は、印刷する前にログインすると、記事の全コンテンツが読み込まれ、PDF に変換できるようになります。
ダーク モードまたはカスタム カラー スキームを使用した Web ページは、色が反転したり、背景が欠けたりして印刷される場合があります。多くの場合、ブラウザーの印刷ダイアログには、背景を印刷するオプションが含まれています。ページで暗い背景と明るいテキストが使用されており、背景なしで印刷すると見えなくなる場合は、このオプションを有効にします。
ステップバイステップの写真を含むレシピやチュートリアルの場合、印刷レイアウトでは各ステップを写真とともに保持する必要があります。改ページによって写真と手順の説明が区切られている場合は、印刷余白を調整するか、リーダー モードを使用して写真と手順の説明をまとめます。
Web ページを PDF として保存した後、ページの URL とアクセス日をメモとして最初のページまたは PDF メタデータに追加します。この出所情報は、保存した記事を数か月後に参照し、元の Web ページが更新されているかどうかを確認する必要がある場合に役立ちます。
保存された Web ページ PDF のコレクションは、フォルダーを使用するか、PDF メタデータにカテゴリ タグを追加することによってカテゴリに整理できます。保存時の整理作業により、保存記事が整理されずに山積みになることを防ぎます。
遅延読み込みされた画像や JavaScript で生成されたテーブルなど、最初のページのレンダリング後に読み込まれる動的コンテンツを含む Web ページの場合は、すべてのコンテンツが読み込まれるまで待ってから印刷してください。ページ全体をスクロールして、遅延読み込みをトリガーします。印刷キャプチャは、現在のページ状態のスナップショットです。
一部の Web サイトでは、印刷リクエストを検出し、CSS メディア クエリを通じてページの印刷に最適化されたバージョンを提供します。印刷版では、コンテンツが再配置され、ナビゲーションが非表示になり、フォント サイズが調整される場合があります。印刷バージョンが適切に設計されている場合は、追加のクリーンアップを行わなくても、デフォルトの印刷出力が受け入れられる可能性があります。
保存された Web ページ PDF は、コンテンツの永久コピーとなり、Web 上で変更されたり消失したりする可能性があります。 PDF には、元の Web サイトの可用性とは関係なく、保存時に存在していたコンテンツがキャプチャされます。この永続性が、ブックマークに依存せずに Web ページを PDF として保存する主な理由です。
保存された Web ページ PDF のよく整理されたコレクションは、適切に名前が付けられ、分類されており、個人の知識ベースとして機能し、時間の経過とともに増加し、インターネット接続や Web サイトの変更に関係なくアクセスし続けることができます。
ブラウザー リーダー モードと専用のクリーン プリント拡張機能は、発行者が設計した Web ページ プレゼンテーションからユーザーが必要とするコンテンツを抽出するという同じ目標に対する 2 つの異なるアプローチを表しており、各アプローチはさまざまな種類の Web コンテンツに対してより適切に機能します。
保存された Web ページ PDF は、ある時点のスナップショットであり、コンテンツを見つけたときに存在していた状態で保存されています。研究、法律、参照の目的で、このスナップショットにはブックマークやリンクにはない証拠的な価値があります。
Web ページからクリーンでコンテンツ中心の PDF を保存できる機能により、Web コンテンツを安定したポータブル形式でキャプチャすることに依存する調査、参照、およびアーカイブのワークフローがサポートされます。
Web コンテンツを PDF 形式にクリーンに抽出すると、元の Web サイトの継続的な存在から独立した永続的でポータブルな記録が作成され、研究の引用、法的証拠、および個人的な参考資料のコレクションとして価値があります。
Web ページを PDF として保存する前にクリーンアップに費やした数分は、保存したドキュメントが参照されるたびに元が取れます。クリーンな PDF は、元の Web サイトのインターフェイスをナビゲートする手間をかけずに読み取り、検索、共有できるためです。
Web ページから必要なコンテンツだけを抽出し、クリーンで読みやすい PDF として保存する機能により、一時的な Web コンテンツが、参照、検索、共有できる永続的な個人ドキュメントに変換されます。
Web コンテンツをクリーンな PDF として保存することは、学術研究や法的文書からレシピ集やチュートリアルのアーカイブに至るまで、個人および専門の幅広いワークフローをサポートしており、それぞれが PDF 形式の永続性と移植性の恩恵を受けています。
Web ページからきれいな PDF を作成するために必要ないくつかの追加手順、リーダー モードのアクティブ化、印刷設定の調整、不要な要素の削除は、保存されたコンテンツの将来の使いやすさへの投資であり、コンテンツをより読みやすく、より共有しやすく、よりプロフェッショナルな外観にします。
乱雑な Web ページを、読者が重視するコンテンツのみを含むクリーンで焦点を絞った PDF に変換することは、Web サイトをキャプチャすることと、Web サイトが伝えるために構築された情報をキャプチャすることの違いを表します。
Web ページから保存されたクリーンな PDF には、重要なコンテンツが永続的な形式で保存されます。
Web ページからクリーンな PDF を保存すると、一時的なオンライン コンテンツが永続的な個人ドキュメントに変わり、元の Web ページが変更されたりインターネットから消えたりした後も、アクセスして読み続けることができます。
Web ページから保存されたクリーンな PDF は、コンテンツを最高の状態でキャプチャします。
| メソッド | 最適な用途 | 出力品質 | 努力 |
|---|---|---|---|
| ブラウザリーダーモード | 記事、ブログ投稿 | クリーン;良いタイポグラフィー | ワンクリック |
| 印刷フレンドリーな拡張機能 | リーダーモードのないページ | カスタマイズ可能。要素を削除する | 数回のクリック |
| 要素の手動削除 | 特定の不要なセクションを含むページ | 正確な制御 | 高い;開発者ツール |
| ワープロにコピー&ペースト | テキストのみのコンテンツ | 基本;画像は手動で挿入する必要がある場合があります | 中くらい |
Word から PDF への変換を試してみる
インストールは必要ありません。ブラウザで直接動作します。
