Skip to content

Come conservare e documentare una fonte web

Crea un fascicolo di prove web verificabile con URL, timestamp, acquisizioni contestuali, archivi, hash dei file, limitazioni e citazioni accurate.

Risposta rapida

Risposta rapida a Come conservare e documentare una fonte web

Registra gli URL inseriti e finali, l'ora di recupero UTC, titolo, autore, date visibili, passaggio rilevante e posizione della fonte. Salva screenshot contestuali più il file originale o una rappresentazione più completa della pagina quando necessario, crea e verifica un archivio indipendente e registra un digest SHA-256 per i file locali non modificati. Mantieni gli originali separati dalle annotazioni e dichiara ogni lacuna o trasformazione dell'acquisizione.

  • Uno screenshot da solo non conserva reindirizzamenti, metadati della fonte, stato interattivo o contesto sufficiente perché un'altra persona possa riprodurre il risultato.
  • Verifica una pagina archiviata dopo l'acquisizione perché gli archivi di singole pagine possono perdere script, media, sezioni espanse e documenti collegati.
  • Un hash corrispondente supporta l'integrità a livello di byte da quando il digest è stato registrato; non prova paternità, autenticità, tempo o verità.

Argomenti: Conservazione web · Registri di prove · Archivi web · Integrità dei file

Uno screenshot conserva i pixel. Non conserva, di per sé, l'URL, l'ora di recupero, i reindirizzamenti, la struttura della pagina, il file scaricabile o contesto sufficiente perché un'altra persona possa riprodurre ciò che hai visto.

Un record difendibile di una fonte web è un piccolo fascicolo di prove: metadati della fonte, acquisizioni contestuali, un archivio indipendente quando appropriato, informazioni sull'integrità dei file salvati e un registro che indica esattamente cosa prova ogni elemento.

Acquisisci la fonte prima di analizzarla

Avvia un registro delle prove mentre la pagina live è aperta. Registra:

  • l'URL che hai inserito e l'URL finale dopo i reindirizzamenti
  • data e ora di recupero con fuso orario, preferibilmente UTC
  • titolo della pagina, sito o editore, autore nominato e date visibili
  • l'URL canonico dichiarato dalla pagina, quando disponibile
  • l'affermazione o il passaggio che stai conservando e dove appare
  • link, ID documento, ID video, numeri di pagina o timestamp necessari per tornare allo stesso punto
  • se la pagina richiedeva login, abbonamento, interazione o accesso regionale

Copia il testo rilevante nelle tue note senza correggere silenziosamente ortografia o punteggiatura. Metti le omissioni tra parentesi quadre o contrassegnale esplicitamente. Mantieni abbastanza testo circostante per mostrare se il passaggio è una citazione, titolo, accusa, correzione, didascalia o risposta a qualcun altro.

Salva più di una rappresentazione

Nessun formato singolo cattura ogni proprietà utile. Per ricerche importanti, considera un fascicolo proporzionato:

  1. Screenshot contestuale. Includi la barra degli indirizzi o altrimenti collega l'immagine all'URL, più il titolo, il passaggio rilevante e la data visibile quando possibile.
  2. Acquisizione a pagina intera o stampa in PDF. Utile per l'ordine di lettura e il contesto più ampio, ma ispezionala perché gli stili di stampa possono nascondere navigazione, commenti, grafici interattivi o testo espanso.
  3. File scaricabile originale. Salva un PDF collegato, immagine, dataset o trascrizione come consegnato; non sostituirlo con uno screenshot del file.
  4. Acquisizione HTML o archivio web. Utile quando contano link, struttura o riproduzione, ma contenuti renderizzati da script e risorse remote potrebbero non salvarsi correttamente.
  5. Note sull'interazione. Registra quale scheda, filtro, elemento espandibile o timestamp video ha esposto la prova.

Mantieni la prima copia salvata invariata. Se ritaglia, annoti, oscuri, transcodifichi o estrai testo, crea una copia di lavoro e registra la trasformazione. Un'annotazione non dovrebbe mai diventare indistinguibile dall'originale acquisito.

Crea un archivio indipendente quando appropriato

Un archivio di terze parti può fornire un riferimento pubblico stabile indipendente dal tuo dispositivo.

Il Save Page Now di Wayback Machine accetta un URL di pagina e restituisce un URL archiviato permanente quando il salvataggio riesce. Internet Archive spiega che salva la singola pagina inviata, non l'intero sito o le pagine collegate da essa. Perma.cc crea similmente un record stabile per una pagina inviata e consiglia agli utenti di rivedere il record finito per confermare che si visualizzi correttamente.

Dopo l'archiviazione:

  • apri l'URL archiviato in un contesto browser nuovo
  • verifica che il testo, l'immagine, la data e il layout rilevanti siano presenti
  • testa se un documento incorporato, audio, video o sezione espansa è sopravvissuto
  • registra l'URL dell'archivio e il suo timestamp di acquisizione
  • conserva l'URL live accanto all'URL dell'archivio

Un fallimento dell'archivio non è prova che una pagina non sia mai esistita. Muri di login, regole robots, script, media in streaming, limiti di velocità ed errori transitori possono tutti impedire un'acquisizione completa. Perma.cc documenta anche che conserva la pagina mirata piuttosto che conservare ricorsivamente ogni pagina collegata. Archivia ogni fonte collegata essenziale separatamente.

Non usare una nuova acquisizione d'archivio per riscrivere il passato. Prova ciò che l'archivio ha acquisito in quel momento, non ciò che la pagina conteneva ieri o quando è stata pubblicata per la prima volta.

Registra l'integrità del file con un hash

Per i file salvati localmente, calcola un digest SHA-256 e inseriscilo nel registro delle prove accanto al nome file, dimensione e ora di acquisizione. Il Secure Hash Standard del NIST specifica SHA-256 tra gli algoritmi che generano digest di messaggio utilizzati per rilevare se i dati sono cambiati da quando il digest è stato generato.

L'interpretazione deve rimanere ristretta: se lo stesso file produce successivamente lo stesso digest, i suoi byte sono invariati rispetto alla copia registrata. Un hash non prova chi ha creato il file, se la pagina live era autentica, se l'orologio del tuo computer era corretto o se il contenuto era vero.

Genera il digest il prima possibile, mantieni l'originale in sola lettura quando il tuo flusso di lavoro lo consente e calcola un nuovo digest per ogni copia trasformata. Non sovrascrivere l'hash originale dopo aver modificato un file.

Usa un registro delle prove che un'altra persona possa verificare

Una riga per elemento è più facile da verificare di una cartella di screenshot non spiegati:

CampoEsempio di cosa registrare
ID provaWEB-2026-001
Fonte liveURL esatto e URL finale reindirizzato
RecuperoData ISO, ora e fuso orario
DescrizioneTitolo della pagina e affermazione o passaggio conservato
FileNome file originale, formato, dimensione in byte e digest SHA-256
ArchivioURL archivio stabile e timestamp di acquisizione
MetodoScreenshot, stampa in PDF, download, salvataggio HTML o esportazione
LimitiMedia mancanti, login richiesto, testo troncato, stato dinamico o altra lacuna
ModificheRitaglio, annotazione, oscuramento, OCR o conversione applicati a una copia

Usa nomi file coerenti che non dipendano dalla memoria, come un ID prova, data UTC, dominio e breve etichetta della pagina. Mantieni il registro separato dai file acquisiti così può descrivere anche elementi mancanti, corrotti o sostituiti.

Per flussi di lavoro di team o legali, registra chi ha acquisito, trasferito, aperto, copiato o trasformato il materiale e quando. La procedura di catena di custodia richiesta dipende dal foro e dalla giurisdizione; questa guida è pratica di documentazione, non consulenza legale o promessa di ammissibilità.

Cita ciò che hai effettivamente conservato

Una citazione web utile di solito include l'autore o l'organizzazione, titolo della pagina, data di pubblicazione o aggiornamento quando supportata, URL live, URL archiviato e la tua data di recupero. Aggiungi un'intestazione di sezione, descrizione del paragrafo, numero di pagina o timestamp media così i lettori possono trovare la prova rilevante.

Non citare una homepage archiviata quando la tua affermazione proveniva da un PDF collegato. Non citare uno snippet di risultato di ricerca quando hai aperto la pagina sottostante. Se le versioni live e archiviate differiscono, indica quale versione supporta l'affermazione e conserva entrambe quando la modifica conta.

Ricontrolla il fascicolo prima di fare affidamento su di esso

Esegui una breve verifica:

  • un'altra persona può aprire l'archivio e localizzare il passaggio?
  • lo screenshot mostra abbastanza contesto della fonte?
  • il file salvato corrisponde ancora al suo digest registrato?
  • gli URL live e finali sono distinti?
  • ora di pubblicazione, ora di recupero e ora dell'archivio sono etichettate separatamente?
  • lacune e trasformazioni sono dichiarate?

Se qualche risposta è no, ripara il record mentre la fonte è ancora disponibile o dichiara chiaramente la limitazione.

Conserva proporzionatamente e legalmente

La disponibilità pubblica non è un permesso generale di ripubblicazione. Possono ancora applicarsi restrizioni di copyright, privacy, protezione dei dati, ordini del tribunale e contrattuali. Conserva solo ciò che il tuo scopo legittimo richiede, limita l'accesso a materiale sensibile e oscura i dati personali dalle copie di lavoro o condivise senza alterare l'originale conservato.

Non creare archivi pubblici di credenziali esposte, materiale intimo, dati di minori, dettagli di contatto privati o informazioni la cui ripubblicazione creerebbe un rischio di sicurezza prevedibile. Non eludere i controlli di accesso. Quando una breve citazione e una citazione affidabile supportano il lavoro, non ripubblicare un'intera pagina protetta da copyright.

Se devi ricostruire stati precedenti, usa come trovare la versione più antica di una pagina web. Per un'affermazione che si è diffusa attraverso citazioni ripetute, continua con come rintracciare una citazione alla sua fonte originale.

Applica questo metodo in un flusso di lavoro di ricerca

Usa la panoramica DeepSearch Research per scegliere un punto di partenza, poi segui il flusso di lavoro di confronto delle fonti. Le guide pubbliche sono gratuite; l'esecuzione di Research richiede accesso a pagamento.

Continua a leggere