Tips & Tricks

如何將網頁的一部分轉換為乾淨的單頁 PDF,沒有廣告或導航

您找到想要另存為 PDF 的文章、食譜、教學或參考頁面。您按 Ctrl+P,選擇“另存為 PDF”,結果一團糟。該 PDF 包括帶有導航選單的網站標題、帶有廣告和相關貼文的側邊欄、帶有版權和社交媒體連結的頁腳以及帶有數十個用戶貼文的評論部分。您想要的實際內容僅填入每個頁面的中間三分之一。

Web 到 PDF 輸出從整個網頁轉換為您想要的內容部分需要使用瀏覽器閱讀器模式、專用的乾淨列印擴充功能或手動頁面設定調整。目標是 PDF 只包含內容,格式清晰便於閱讀,沒有分散注意力的介面元素。

How to Convert a Section of a Webpage Into a Clean Single-Page PDF Without Ads or Navigation

使用瀏覽器閱讀器模式進行乾淨的 PDF 輸出

大多數現代瀏覽器都包含閱讀器模式,可從網頁中提取主要內容並以乾淨、無幹擾的格式顯示。在 Chrome、Edge 和 Firefox 中,當瀏覽器偵測到頁面上的文章時,閱讀器模式圖示會出現在網址列中。按一下該圖示進入閱讀器模式,然後從閱讀器模式檢視列印為 PDF。

閱讀器模式產生的 PDF 輸出比列印整個網頁乾淨得多。閱讀器模式去除了導覽、側邊欄、廣告和評論,只留下文章標題、文字和圖像。文字採用適當大小的可讀字體格式。結果看起來像是文件而不是網站的螢幕截圖。

並非所有網頁都會觸發閱讀器模式。食譜網站、教學頁面和長篇文章通常效果很好。產品頁面、論壇主題和互動式 Web 應用程式通常不會。如果閱讀器模式不可用,請使用下述替代方法之一。

WukongPDF

嘗試將 Word 轉為 PDF

無需安裝。直接在您的瀏覽器中工作。

立即開始 →

乾淨網頁到 PDF 轉換的替代方法

PrintFriendly 和 PDF、Mercury Reader 和 Clearly 等瀏覽器擴充功能提供了超越內建閱讀器模式的增強型乾淨列印功能。這些擴充功能可以在列印前刪除特定的頁面元素、調整文字大小以及將多頁文章合併到單一流動文件中。

WukongPDF提供PDF匯出工具,可以處理儲存為HTML或列印為PDF的網頁內容。該平台可以裁剪、清理和重新格式化 PDF 輸出,以刪除不需要的元素。

使用瀏覽器開發人員工具的手動方法可以在列印之前刪除特定元素。右鍵單擊不需要的元素,選擇“檢查”,然後從 HTML 中刪除該元素節點。對每個不需要的元素重複此操作。將清理後的頁面列印為 PDF。這種方法提供了精確的控制,但一次性轉換非常耗時。

配置網頁 PDF 輸出的列印設定

在將網頁列印為 PDF 之前,請開啟瀏覽器列印對話方塊並調整設定。將邊距設為“最小”或“無”以最大化內容區域。如果頁面使用背景顏色或屬於內容一部分的圖像,則啟用背景圖形。停用頁首和頁尾以避免 URL、日期和頁碼覆蓋在已儲存的 PDF 上。

對於PDF格式最佳化,選擇與內容相符的紙張尺寸。包含大圖像的寬幅文章可能會受益於橫向方向。窄文本列可能會受益於調整邊距的縱向方向。瀏覽器列印預覽顯示內容如何適合所選的紙張尺寸。

如果網頁內容跨越多個列印頁面且分頁不方便,請先使用閱讀器模式,該模式會將文字重排為單列。重排的文字在段落邊界處自然地跨頁面中斷,而不是在段落內的任意位置處中斷。

組織保存的網頁 PDF

使用文章標題和日期命名已儲存的 PDF。描述性檔案名稱使 PDF 可以在您的檔案系統中找到。將網頁 PDF 儲存到專用資料夾,而不是與其他文件混合。保存文章的資料夾成為個人參考庫。

如果您將許多網頁儲存為 PDF,請將來源 URL 新增至 PDF 元資料或第一頁的註釋。如果您需要檢查更新或與其他人共享鏈接,則可以透過該 URL 返回即時網頁。

一些網站使用無限滾動來在讀者向下滾動時加載附加內容。列印無限滾動頁面僅捕獲當前載入的內容。捲動到頁面底部以在列印為 PDF 之前加載所有內容。

付費文章可能無法完整列印。可以列印可見的預覽,但不能列印付費專區後面的完整文章。如果您有訂閱,請在列印前登錄,以便載入完整的文章內容並可用於 PDF 轉換。

使用深色模式或自訂配色方案的網頁列印時可能會出現反色或缺少背景的情況。瀏覽器列印對話方塊通常包含列印背景的選項。如果頁面使用深色背景和淺色文字(在沒有背景的情況下列印時變得不可見),請啟用此選項。

對於包含逐步照片的食譜和教程,列印佈局應保留每個步驟及其照片。如果分頁符號將照片與其步驟說明分開,請調整列印邊距或使用閱讀器模式將它們放在一起。

將網頁儲存為 PDF 後,將頁面 URL 和存取日期新增為首頁或 PDF 元資料中的註釋。當您在幾個月後引用保存的文章並需要檢查原始網頁是否已更新時,此出處資訊非常有價值。

可以使用資料夾或透過向 PDF 元資料新增類別標籤來將已儲存的網頁 PDF 集合組織為類別。保存時的組織工作可防止堆積未分類的保存文章。

對於在初始頁面呈現後載入的動態內容的網頁(例如延遲載入的圖片或 JavaScript 產生的表格),請等待所有內容載入後再列印。捲動整個頁面以觸發延遲載入。列印擷取是目前頁面狀態的快照。

一些網站檢測列印請求並透過 CSS 媒體查詢提供頁面的列印優化版本。列印版本可能會重新排列內容、隱藏導覽和調整字體大小。如果列印版本設計良好,預設列印輸出可能是可以接受的,無需額外的清理。

儲存的網頁 PDF 成為內容的永久副本,可能會從網路上變更或消失。 PDF 擷取保存時存在的內容,與原始網站的可用性無關。這種持久性是將網頁儲存為 PDF 而不是依賴書籤的主要原因。

已保存的網頁 PDF 的組織良好的集合,經過正確命名和分類,可作為個人知識庫,隨著時間的推移而增長,並且無論互聯網連接或網站如何變化,都可以保持可訪問性。

瀏覽器閱讀器模式和專用的乾淨列印擴充功能代表了實現相同目標的兩種不同方法,即從發布者設計的網頁呈現中提取使用者想要的內容,並且每種方法更適合不同類型的 Web 內容。

儲存的網頁 PDF 是及時的快照,保留了您發現內容時的原樣。出於研究、法律和參考目的,此快照具有書籤或連結所沒有的證據價值。

從網頁保存乾淨、以內容為中心的 PDF 的能力支援依賴於以穩定、可攜式格式擷取 Web 內容的研究、參考和歸檔工作流程。

將網頁內容乾淨地提取為 PDF 格式會創建一個永久、可移植的記錄,該記錄獨立於原始網站的繼續存在,這使其對於研究引文、法律證據和個人參考收藏很有價值。

每次引用已儲存的文件時,在儲存為 PDF 之前清理網頁所花費的幾分鐘都會得到回報,因為可以閱讀、搜尋和共享乾淨的 PDF,而無需在原始網站介面中導航。

能夠從網頁中提取您想要的內容並將其另存為乾淨、可讀的 PDF,將短暫的 Web 內容轉換為您可以引用、搜尋和共享的永久個人文件。

將網頁內容儲存為乾淨的 PDF 的做法支援廣泛的個人和專業工作流程,從學術研究和法律文件到食譜收集和教程存檔,每個工作流程都受益於 PDF 格式的持久性和可移植性。

從網頁產生乾淨的 PDF 所需的幾個額外步驟、啟動閱讀器模式、調整列印設定、刪除不需要的元素,是對所保存內容的未來可用性的投資,使其更具可讀性、更可共享且外觀更專業。

將雜亂的網頁轉換為乾淨、重點突出的 PDF(僅包含讀者重視的內容)代表了捕獲網站和捕獲網站旨在傳達的訊息之間的區別。

從網頁儲存的乾淨 PDF 會以永久格式保留您重視的內容。

從網頁中保存乾淨的 PDF 可將轉瞬即逝的線上內容轉變為永久的個人文檔,即使原始網頁已更改或從互聯網上消失很長時間,這些文檔仍可訪問和可讀。

從網頁儲存的乾淨 PDF 可捕捉最佳內容。

方法最適合輸出質量努力
瀏覽器閱讀器模式文章、部落格文章乾淨的;良好的排版一鍵點擊
列印友善擴展沒有閱讀器模式的頁面可自訂;刪除元素點擊幾下
手動刪除元素包含特定不需要的部分的頁面精準控制高的;開發者工具
複製並貼上到文字處理程序純文字內容基本的;圖片可能需要手動插入中等的
WukongPDF

嘗試將 Word 轉為 PDF

無需安裝。直接在您的瀏覽器中工作。

立即開始 →