Trovi l'articolo perfetto online e salvalo come PDF utilizzando la funzione di stampa del browser. Il PDF risultante non assomiglia per niente alla pagina web che stavi leggendo. Mancano le immagini. Il testo si sovrappone. Il layout pulito e leggibile sullo schermo è un pasticcio confuso nella pagina PDF. La conversione da Web a PDF del browser è comoda ma imprecisa e produce un output che si avvicina anziché replicare la pagina Web originale.
Le funzioni di stampa su PDF del browser utilizzano il foglio di stile CSS di stampa della pagina Web, non il CSS dello schermo. Gli sviluppatori Web spesso creano un layout semplificato specifico per la stampa che rimuove la navigazione, le barre laterali e gli annunci pubblicitari. Questo layout di stampa può apparire notevolmente diverso da quello che vedi sullo schermo. La differenza è intenzionale, progettata per produrre risultati stampati più puliti, ma può essere sorprendente.

Perché l'output di stampa del browser è diverso dalla visualizzazione sullo schermo
Le pagine Web utilizzano due fogli di stile CSS separati: uno per la visualizzazione sullo schermo e uno per la stampa. Il foglio di stile dello schermo controlla ciò che vedi nel browser. Il foglio di stile di stampa controlla cosa appare quando stampi o salvi come PDF. I due fogli di stile possono specificare layout, caratteri, colori e persino contenuti completamente diversi.
La conversione Formato PDF rimuove anche gli elementi interattivi. I menu a discesa, i contenuti a schede, i caroselli e le sezioni a fisarmonica che richiedono il clic o il passaggio del mouse per rivelare il contenuto producono un output PDF incompleto. Il PDF cattura solo lo stato attualmente visibile di questi elementi, che potrebbe essere il loro stato compresso o nascosto.
Il foglio di stile di stampa spiega la maggior parte delle sorprese.
Il foglio di stile di stampa è il principale colpevole dietro la maggior parte delle sorprese del layout.
Il contenuto dinamico caricato da JavaScript dopo il caricamento iniziale della pagina potrebbe non essere visualizzato nel PDF. Pagine a scorrimento infinito, immagini caricate lentamente e contenuti che richiedono l'interazione dell'utente per essere caricati sono particolarmente vulnerabili. Il browser stampa ciò che è attualmente caricato nel DOM, che potrebbe essere solo una frazione del contenuto totale della pagina.
Prova Word in PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
Problemi comuni di stampa e come risolverli
Le immagini mancanti nell'output PDF di solito derivano dal foglio di stile di stampa che nasconde le immagini per risparmiare inchiostro o da immagini caricate lentamente che non erano state caricate quando è stata avviata la stampa. Scorri l'intera pagina per attivare il caricamento lento prima della stampa. Disabilitare il foglio di stile di stampa negli strumenti di sviluppo del browser per forzare l'utilizzo del layout dello schermo per la stampa.
WukongPDF può elaborare l'output risultante di Visualizzazione PDF per regolare le dimensioni della pagina e rimuovere elementi indesiderati, ma non può ripristinare il contenuto che il browser ha omesso durante l'acquisizione della stampa.
Utilizzo della modalità Lettore per un output PDF più pulito
La maggior parte dei browser include una modalità lettore che estrae il contenuto principale e lo visualizza in un formato pulito, a colonna singola. Attiva la modalità lettore prima di stampare su PDF. L'output in modalità lettore è più semplice dell'intera pagina Web ma più affidabile, con un flusso di testo coerente e nessun contenuto mancante.
Strumenti dedicati per convertire le pagine Web in PDF rispetto alla stampa dal browser
Gli strumenti di acquisizione di pagine Web dedicati producono output PDF più affidabili rispetto alle funzioni di stampa del browser. Questi strumenti eseguono il rendering completo della pagina, attendono il caricamento di tutto il contenuto e acquisiscono il layout dello schermo anziché il layout di stampa. L'output corrisponde maggiormente a ciò che vedi sullo schermo.
Per le pagine Web che devono essere acquisite accuratamente come PDF, testa sia la funzione di stampa del browser che uno strumento di acquisizione dedicato. Confronta l'output. Lo strumento che produce il miglior risultato per una pagina web potrebbe non esserlo per un'altra. La variabilità del design delle pagine web fa sì che nessun metodo funzioni perfettamente per tutte le pagine.
Gestione di contenuti Web multipagina
Gli articoli lunghi che si estendono su più pagine stampate nell'output PDF spesso presentano interruzioni di pagina scomode che tagliano le immagini o dividono i paragrafi a metà frase. L'algoritmo di impaginazione del browser non comprende i confini del contenuto. Suddivide le pagine in posizioni fisse in base al formato della carta.
Utilizza l'anteprima di stampa del browser per identificare dove si verificheranno le interruzioni di pagina. Regola la scala di stampa, i margini o il formato della carta per spostare le interruzioni di pagina in posizioni più naturali. Una leggera riduzione della scala, dal 100% al 95%, può spostare le interruzioni di pagina abbastanza da evitare le peggiori suddivisioni del contenuto.
Per gli articoli suddivisi su molte pagine PDF, valuta la possibilità di utilizzare un editor PDF dopo l'acquisizione per combinare contenuti frammentati. Ritaglia le immagini delle singole pagine e riassemblale in un documento continuo che scorre in modo più naturale rispetto alle interruzioni di pagina imposte dal browser.
Preservare i contenuti interattivi e dinamici
Le pagine Web con video, audio o grafici interattivi incorporati perdono questi elementi nell'output PDF. Il PDF cattura un'immagine statica dello stato corrente. Per i contenuti in cui l'elemento interattivo è essenziale, includi l'URL della pagina Web originale nel PDF in modo che i lettori possano accedere alla versione interattiva completa.
I collegamenti nel PDF acquisito potrebbero non essere selezionabili. La funzione di stampa del browser a volte converte il testo in contorni vettoriali o immagini raster che non conservano i collegamenti ipertestuali. Testare l'output PDF facendo clic su un collegamento noto per verificare la funzionalità del collegamento. Se i collegamenti vengono persi, utilizza un editor PDF per aggiungerli nuovamente manualmente.
Gli incorporamenti dei social media, le sezioni dei commenti e i contenuti correlati caricati dinamicamente raramente sopravvivono al processo di stampa in PDF. Se questi elementi sono importanti, acquisiscili separatamente come screenshot e inseriscili nel PDF dopo l'acquisizione del contenuto principale.
Le pagine Web progettate con layout reattivi possono presentare un layout diverso sul motore di stampa rispetto a quello sullo schermo. Un design mobile-responsive che appare pulito su un telefono potrebbe essere stampato come una colonna stretta con uno spazio bianco eccessivo. Testare l'output di stampa con diverse larghezze della finestra del browser può identificare la dimensione della finestra che produce il miglior output PDF.
Le pagine Web che utilizzano CSS Grid o Flexbox per il layout potrebbero ridisporre in modo imprevedibile una volta stampate perché il foglio di stile di stampa spesso sostituisce il layout complesso dello schermo con un layout lineare semplificato. I contenuti visualizzati uno accanto all'altro sullo schermo appaiono impilati verticalmente nel PDF.
I caratteri personalizzati caricati da servizi Web come Google Fonts o Adobe Fonts potrebbero non essere disponibili per il motore di stampa del browser. L'output di stampa sostituisce i caratteri di sistema, modificando l'aspetto del testo, la lunghezza delle righe e le interruzioni di pagina.
Le immagini di sfondo e le sfumature applicate tramite CSS in genere non vengono stampate per impostazione predefinita per risparmiare inchiostro. Una sezione che si basava su uno sfondo scuro con testo chiaro per la leggibilità potrebbe diventare invisibile quando lo sfondo viene rimosso e rimane il testo chiaro.
Le pagine Web con intestazioni fisse o barre di navigazione permanenti possono essere visualizzate al centro del contenuto PDF di ogni pagina. Questi elementi sono posizionati rispetto al viewport, non al contenuto della pagina, e il loro posizionamento fisso viene perso nella conversione PDF.
Il livello di zoom del browser durante la stampa influisce sull'output PDF. Una pagina stampata con uno zoom del 100% produce risultati diversi rispetto alla stessa pagina stampata con uno zoom del 75%. Il livello di zoom modifica le dimensioni del testo e il conteggio delle pagine.
La stampa di una pagina Web da un browser mobile produce risultati diversi rispetto alla stampa da un browser desktop perché i browser mobili spesso forniscono una versione semplificata della pagina al motore di stampa.
Nelle pagine Web protette da login o paywall, il PDF stampato potrebbe includere contenuti visibili solo dopo l'autenticazione. Il PDF diventa una registrazione del contenuto autenticato e deve essere trattato con la dovuta sicurezza.
Le estensioni del browser che modificano l'aspetto della pagina Web, come il blocco degli annunci, le estensioni della modalità oscura e i fogli di stile personalizzati, influiscono sull'output di stampa. Il PDF stampato riflette la pagina modificata così come la presenta l'estensione.
Il salvataggio di una pagina Web come PDF è fondamentalmente un'istantanea di un supporto dinamico in un formato statico. La conversione cattura la pagina in un determinato momento, bloccando il contenuto che potrebbe cambiare pochi minuti dopo.
A fini di archiviazione, un PDF salvato da una pagina web dovrebbe includere l'URL e la data di accesso nei metadati del documento o sulla prima pagina in modo che i futuri lettori possano individuare la fonte originale.
Le pagine Web con framework JavaScript pesanti come React, Angular o Vue potrebbero non visualizzare quasi nulla nell'output PDF perché il motore di stampa acquisisce la pagina prima che JavaScript abbia finito di costruire il DOM. Attendere diversi secondi dopo che la pagina sembra essere stata caricata prima della stampa, dà al framework il tempo di completare il rendering.
Le query multimediali CSS destinate alla stampa possono nascondere o mostrare elementi specifici. Un foglio di stile di stampa ben progettato include il contenuto principale ed esclude navigazione, pubblicità e commenti. Un foglio di stile di stampa mal progettato o assente ricade nel layout dello schermo, che potrebbe non tradursi bene nelle dimensioni fisse della pagina di un PDF.
La cache del browser influisce sull'output PDF durante la stampa di pagine che richiedono l'autenticazione. Se il browser dispone di credenziali memorizzate nella cache, l'output di stampa include contenuto autenticato. Se la sessione è scaduta, l'output di stampa potrebbe mostrare una pagina di accesso invece del contenuto previsto. Verificare il contenuto della pagina prima della stampa scorrendo l'intera pagina.
La stampa di una pagina Web che contiene iframe incorporati da altri domini potrebbe produrre aree vuote in cui dovrebbe apparire il contenuto dell'iframe. Le restrizioni multiorigine impediscono al motore di stampa di accedere al contenuto iframe da domini diversi. L'output PDF mostra rettangoli vuoti in cui il contenuto incorporato era sullo schermo.
Per le acquisizioni di pagine Web critiche, utilizza la funzione Salva con nome del browser per salvare la pagina Web completa, HTML e le risorse, prima di stampare in PDF. La copia salvata funge da riferimento per come dovrebbe apparire la pagina e puoi confrontare l'output PDF con la copia salvata per identificare cosa è andato perso durante la conversione della stampa.
Prova Word in PDF
Nessuna installazione necessaria. Funziona direttamente nel tuo browser.
