SU
StrumentiUtili.it
Micro-strumenti gratuiti 100% client-side
← Torna alla categoria PDF & Scanner
📄 Gestione Documenti

Unisci, Riordina e Dividi PDF

Organizza le pagine dei tuoi file PDF trascinandole, unisci più documenti insieme o estrai solo le pagine che ti interessano. L'elaborazione avviene localmente nel tuo browser.

Organizzatore (Unisci e Riordina)

Carica più PDF. Trascina le miniature per riordinarle e unisci tutto in un nuovo documento.

Estrazione Rapida (Dividi)

Estrai pagine specifiche da un PDF e salvale come file separato.

Affidabilità di questo strumento

📅 Comportamento di unione ed estrazione verificato a

👨‍💻 Chi lo ha realizzato

Sviluppato e mantenuto da ingegneri software indipendenti. Motore di calcolo basato esclusivamente sulle normative ufficiali vigenti. (Zero-Backend: nessun dato viene inviato a server esterni).

🔒 Privacy Zero-Backend

I PDF vengono letti, riordinati e ricostruiti nel browser: nessun file viene inviato a server. Le librerie pdf.js e pdf-lib sono scaricate da CDN al primo utilizzo e non ricevono i documenti (GDPR, artt. 5 e 25).

📚 Fonti tecniche e normative

ISO 32000 (formato PDF), ETSI EN 319 142 (firme PAdES), Regolamento UE 2016/679 (GDPR), artt. 5, 9, 25, 30 e 32, Linee guida AgID sulla formazione, gestione e conservazione dei documenti informatici, librerie pdf.js e pdf-lib.

Guida Tecnica e Normativa: Gestione Professionale dei PDF Lato Client

La manipolazione algoritmica dei file Portable Document Format (PDF) nei flussi di lavoro professionali — quali studi legali, strutture sanitarie, istituti finanziari e pubbliche amministrazioni — impone il rigoroso rispetto dei vincoli di riservatezza stabiliti dal Regolamento Generale sulla Protezione dei Dati (GDPR, Reg. UE 2016/679). Le architetture tradizionali basate su microservizi cloud costringono l'utente all'upload telematico dei documenti su server remoti di terze parti, innescando criticità sistemiche inerenti alla catena di custodia dei dati, alla sovranità digitale e al rischio d'intercettazione. Questo strumento adotta un'architettura Zero-Backend: il disegno delle anteprime, la copia delle pagine e la scrittura del file finale avvengono nella memoria del browser, con le librerie JavaScript pdf.js e pdf-lib. I documenti non vengono trasmessi ad alcun server.

🏛️ Inquadramento Normativo: Compliance GDPR (Art. 25, 28, 30, 35) e Conservazione Sostitutiva

Data Protection by Design e by Default (Art. 25 GDPR): L'Articolo 25 del GDPR codifica il principio cardine secondo cui le misure tecniche ed organizzative a tutela del dato devono essere incorporate direttamente nell'architettura software fin dalla fase di progettazione concettuale. L'infrastruttura 100% client-side concretizza tale dettame in termini matematici. Impedendo fisicamente il trasferimento del payload di rete verso server esterni, il rischio di fuga dati (data breach) durante la fase di transito (Data in Transit) o di stazionamento su storage remoti (Data at Rest) viene annullato alla radice. I file di partenza e quelli generati restano nella memoria della scheda; chiudendola il browser la libera. I file scaricati, invece, restano sul dispositivo e vanno conservati o eliminati secondo le regole dell'organizzazione.

Esenzione dalla Qualifica di Responsabile del Trattamento (Art. 28 GDPR): Nelle architetture SaaS (Software as a Service) tradizionali, il fornitore della piattaforma cloud assume giuridicamente la veste di Responsabile del Trattamento (Data Processor), imponendo al Titolare del Trattamento (es. lo studio legale o l'azienda) la stipula di complessi e onerosi contratti di nomina (Data Processing Agreement - DPA), la verifica periodica delle garanzie di sicurezza dell'infrastruttura del server (Art. 32 GDPR) e l'eventuale gestione del trasferimento dati extra-UE alla luce dei pronunciamenti sanzionatori della Corte di Giustizia Europea (es. sentenza Schrems II). Con l'esecuzione locale il sito fornisce solo il programma e non riceve i documenti: per questa operazione non c'è un fornitore da nominare responsabile del trattamento. Restano gli obblighi generali del titolare, come le misure di sicurezza sui dispositivi e, quando ne ricorrono i presupposti, la valutazione d'impatto sul trattamento nel suo complesso.

Trattamento di Categorie Particolari di Dati (Art. 9 GDPR) e Registro Trattamenti (Art. 30): Quando i documenti oggetto di unione o separazione contengono informazioni sanitarie, biometriche, giudiziarie o relative a minori, l'Articolo 9 del GDPR sancisce il divieto generale di trattamento in assenza di rigide basi giuridiche o consensi espliciti. Operare localmente evita di dover censire nel registro delle attività di trattamento un nuovo fornitore o un trasferimento verso terzi: il trattamento resta quello già previsto per i documenti dell'organizzazione, con le misure di sicurezza sui dispositivi del personale.

Firma Digitale, Standard PAdES e Conservazione Sostitutiva ISO 19005 (PDF/A): La manipolazione dei PDF destinati al Processo Civile Telematico (PCT) o alla conservazione sostitutiva a norma di legge deve preservare la validità legale della firma elettronica integrata. Le firme PAdES (PDF Advanced Electronic Signatures) inseriscono nel dizionario del documento una struttura dati PKCS#7 contenente l'impronta crittografica (hash SHA-256) sigillata con la chiave privata del firmatario. La separazione o la riorganizzazione arbitraria delle pagine di un documento firmato invalida matematicamente l'hash originario per garantire l'immodificabilità dell'atto. Conviene quindi unire o estrarre le pagine prima di firmare: il documento definitivo va firmato per ultimo. Se il formato di destinazione deve essere PDF/A, la conversione va fatta dopo, con lo strumento dedicato: unione ed estrazione non producono un file PDF/A.

⚙️ Meccanica Computazionale, Algoritmi Vettoriali e Gestione della RAM

Architettura di esecuzione (pdf.js e pdf-lib): l'elaborazione usa due librerie che lavorano nel browser. pdf.js decodifica il file, ne legge le tabelle di riferimento incrociato (XRef) e disegna ogni pagina su un elemento Canvas: da qui nascono le miniature usate per il riordino. pdf-lib ricostruisce l'albero degli oggetti del PDF e riscrive il file finale per le operazioni di unione o estrazione. Nessuna delle due usa moduli WebAssembly: sono librerie JavaScript.

Algoritmo di Ricostruzione dei Flussi di Contenuto (Content Stream Synthesis): Quando si esegue la fusione di più file PDF ($D_1, D_2, \dots, D_n$) o l'estrazione di un sottoinsieme di pagine $P = \{p_1, p_2, \dots, p_k\}$, l'algoritmo non effettua una semplice scansione o ricompressione e-image (che degraderebbe la qualità del testo vettoriale), ma esegue le seguenti operazioni ad alto livello:

  • Parsing dell'intestazione (Header) e localizzazione della tabella dei cataloghi radice (Catalog Dictionary).
  • Isolamento dell'albero delle pagine (Pages Tree) e copia profonda (deep-copy) degli oggetti indipendenti, inclusi i dizionari dei font incorporati (Font Descriptors), le risorse grafiche (XObjects) e le mappe di colore.
  • Risoluzione e ricalcolo dei riferimenti agli oggetti indiretti (Indirect Object References) per prevenire conflitti di identificativo univoco (Object Identifier Collisions) all'interno del nuovo dizionario compilato.
  • Riscrittura dinamica del flusso di byte finale, generazione del nuovo catalogo `/Pages` e formattazione della tabella dei riferimenti incrociati ordinata (`xref`) con relativo marcatore finale di chiusura (`startxref` / `%%EOF`).

Che cosa si conserva e che cosa si perde: le pagine copiate mantengono testo, font incorporati, immagini, qualità originale e rotazione (/Rotate): il contenuto non viene rasterizzato né ricompresso. Si perdono invece gli elementi che appartengono al documento nel suo insieme, cioè segnalibri, struttura dei capitoli e moduli compilabili. In una prova con un PDF contenente due campi modulo compilati, dopo l'estrazione di una pagina il testo inserito resta visibile e stampabile, ma il campo non è più un modulo interattivo. Anche le firme digitali PAdES non sopravvivono: vanno apposte dopo l'unione o l'estrazione.

Memoria e Web Worker: unire o dividere fascicoli di grandi dimensioni nel thread principale può bloccare la pagina o esaurire la memoria del browser. Le operazioni pesanti — copia degli oggetti e scrittura del file finale — sono quindi delegate a un Web Worker in background, e i dati vengono passati fra i thread come oggetti trasferibili (Transferable Objects), cioè senza duplicarli in memoria. Resta un limite fisico: il file di partenza, le miniature e il documento generato convivono nella memoria della scheda, quindi con fascicoli di centinaia di megabyte conviene lavorare su un computer desktop e procedere per parti.

💼 Casuistica Reale Resolta e Workflow Operativi Professionali

Caso 1: Studio Legale e Deposito Fascicoli nel Processo Civile Telematico (PCT): Un avvocato deve assemblare la memoria difensiva e i relativi 45 allegati probatori scansionati in un unico fascicolo PDF privo di pagine vuote o doppioni, rispettando rigorosamente il limite dimensionale massimo imposto dalla cancelleria per l'invio della busta telematica (es. 30MB). Caricare questi atti riservati — contenenti dati sensibili di controparti e minori — su portali di conversione cloud commerciali esporrebbe lo studio a gravissime responsabilità per violazione del segreto professionale e del GDPR. Sfruttando lo strumento locale, l'avvocato seleziona i file, trascina le miniature per organizzare la sequenza cronologica, elimina con un click le pagine bianche rilevate visivamente ed estrae le sole sezioni rilevanti. L'elaborazione avviene sul proprio computer e nessun documento esce dallo studio. Il peso del fascicolo va comunque controllato prima dell'invio: se supera il limite della busta telematica, le scansioni possono essere ridotte con lo strumento Comprimi PDF.

Caso 2: Struttura Sanitaria e Trattamento di Cartelle Cliniche per Trial Clinico (Art. 9 GDPR): Un'équipe medica universitaria necessita di estrarre specifici referti diagnostici ed esami di laboratorio da un fascicolo clinico cumulativo di oltre 600 pagine relativo a decine di pazienti, da trasmettere ad un centro di ricerca partner. La normativa sulla privacy vieta tassativamente la comunicazione esterna dei dati identificativi associati alle patologie. Tramite lo strumento di estrazione rapida (Split) localizzato, il personale sanitario seleziona i range di pagine dei singoli referti (es. 12-15, 88-92), separandoli ed estraendoli in singoli file pronti per la successiva fase di oscuramento del nome, senza inviare un singolo byte di dati sanitari non ancora anonimizzati verso infrastrutture web terze.

Caso 3: Operazione M&A Aziendale, Bilanci e Due Diligence Finanziaria: Un team di consulenti finanziari impegnato in un'operazione di fusione e acquisizione (M&A) deve analizzare ed assemblare i bilanci d'esercizio, i verbali del CdA e i registri contabili secretati provenienti da tre diverse holding. I documenti, protetti da stringenti accordi di riservatezza (NDA - Non-Disclosure Agreement), contengono segreti industriali e dati economico-patrimoniali la cui divulgazione involontaria potrebbe configurare reati di insider trading o concorrenza sleale. L'impiego dell'applicativo client-side permette di estrarre le tabelle nota integrative di interesse e riordinarle in un prospetto sintetico per gli auditor, garantendo la totale segregazione informatica da qualsiasi rete esterna.

👥 Casi Pratici ed Esempi Reali

I casi seguenti sono stati riprodotti con lo strumento su documenti di prova di quattro pagine numerate, con la seconda pagina ruotata di 90 gradi; il contenuto dei file scaricati è stato riletto con pdf.js.

Caso 1: estrarre le pagine in un ordine diverso

  • Documento: pagine A1, A2 (ruotata 90°), A3, A4
  • Pagine richieste «3,1» → file con A3, A1
  • Pagine richieste «4-2» → file con A4, A3, A2 (rotazione conservata)
  • Pagina richiesta «9» → «Nessuna pagina valida: il documento ha 4 pagine.»

L'ordine digitato viene rispettato, quindi lo strumento serve anche a riordinare poche pagine senza passare dalle miniature. La pagina ruotata resta ruotata come nell'originale.

Caso 2: unire due fascicoli mantenendo la sequenza

  • Due documenti da 4 pagine caricati insieme: 8 miniature
  • File unito: A1, A2, A3, A4, B1, B2, B3, B4
  • Rotazione delle pagine A2 e B2 conservata (90°)

Le pagine seguono l'ordine dei file caricati; per una sequenza diversa si trascinano le miniature prima di generare il PDF. Il testo resta testo: non c'è alcuna conversione in immagine.

Caso 3: modulo compilato da cui estrarre una pagina

  • PDF con due campi modulo compilati («Mario Rossi» e «Seconda pagina»)
  • Dopo l'estrazione della pagina 1: il testo «Mario Rossi» resta visibile
  • Elenco dei campi del modulo nel file estratto: vuoto

Il valore inserito resta stampabile, ma il campo non è più compilabile né modificabile come modulo. Se il destinatario deve poter ancora compilare il documento, va inviato il PDF originale; se invece serve solo la copia definitiva, l'estrazione produce di fatto un documento non più modificabile nei campi.

FAQ Tecniche, Errore Operativi e Profilo Sanzionatorio

Qual è la differenza fondamentale tra la vera eliminazione e la "falsa redazione" dei testi in un PDF?
L'errore operativo più comune e grave nella gestione dei PDF (noto in ambito informatico forense come "The Redaction Trap", reso celebre dal caso giudiziario Paul Manafort) consiste nell'applicare rettangoli neri o annotazioni di coprenza visiva sopra il testo sensibile mantenendo intatta la struttura vettoriale sottostante. I visualizzatori PDF lavorano su livelli sovrapposti: aggiungere un rettangolo nero crea solo un livello visivo superiore, lasciando il testo in chiaro nel flusso di dati (`content stream`), nei metadati XMP e nel livello invisibile OCR. Un malintenzionato può facilmente selezionare la zona oscurata, copiare il testo e incollarlo altrove per svelare i dati segreti. La vera separazione/anonimizzazione deve decontaminare fisicamente gli oggetti vettoriali e i nodi del file prima della generazione del nuovo output.

Perché i software tradizionali in cloud impongono limiti di peso (es. 10MB o 50MB) e come li supera questo strumento?
I servizi commerciali in cloud pongono limiti rigidi per contenere i costi di banda passante (bandwidth) e l'impatto computazionale sui propri server remoti. In uno strumento 100% client-side, la capacità di elaborazione dipende unicamente dalla RAM e dal processore del dispositivo dell'utente. Qui non ci sono limiti di caricamento, perché i dati non attraversano la rete: il vincolo è la memoria disponibile nel browser, che dipende dal dispositivo. Su computer recenti fascicoli di alcune decine di megabyte si elaborano senza difficoltà; oltre, conviene procedere per parti.

Come evitare l'errore Out-Of-Memory (OOM) o il blocco del browser con file di grandi dimensioni?
L'errore OOM si verifica quando il motore JavaScript satura l'allocazione di memoria associata al singolo processo della scheda (tab). Per evitare il blocco, conviene chiudere le altre schede e, con fascicoli molto voluminosi, estrarre prima i blocchi di pagine che servono invece di caricare l'intero documento. Sui dispositivi mobili il limite si raggiunge molto prima che su un computer desktop.

Quali sanzioni economiche si rischiano violando il GDPR durante la gestione dei file aziendali?
Il caricamento incontrollato di documenti contenenti dati personali o particolari (ex Art. 9) su piattaforme online non conformi, prive di DPA ex Art. 28 o ospitate su server extra-UE privi di decisioni di adeguatezza, costituisce una violazione grave del Regolamento Europeo. Ai sensi dell'Articolo 83 del GDPR, le sanzioni amministrative pecuniarie possono raggiungere fino a 20 milioni di euro o, per le imprese, fino al 4% del fatturato mondiale totale annuo dell'esercizio precedente, a cui si aggiungono le richieste di risarcimento degli interessati. L'elaborazione locale elimina il passaggio dei file a un servizio esterno, ma non sostituisce le altre misure di sicurezza dell'organizzazione.

Domande Frequenti (FAQ)

Le pagine estratte perdono qualità?

No. Le pagine vengono copiate così come sono, senza rasterizzare né ricomprimere: testo, font e immagini restano identici all'originale.

Posso cambiare l'ordine delle pagine mentre le estraggo?

Sì: le pagine escono nell'ordine digitato, quindi «3,1» inverte le due pagine e «5-3» inserisce l'intervallo al contrario.

I segnalibri e i moduli compilabili sopravvivono?

No. Unione ed estrazione ricostruiscono il documento: i segnalibri e i campi modulo interattivi si perdono, mentre i valori già inseriti restano visibili nella pagina.

Posso lavorare su un PDF firmato digitalmente?

Tecnicamente sì, ma la firma non resta valida: qualunque modifica al documento la invalida. Unisci o estrai prima, firma dopo.

Quanto può essere grande il file?

Non c'è un limite imposto dallo strumento, perché nulla viene caricato in rete. Il limite è la memoria del dispositivo: su smartphone si raggiunge molto prima che su un computer.