Skip to content

Wie man eine Webquelle archiviert und dokumentiert

Erstellen Sie ein nachvollziehbares Web-Beweisbündel mit URLs, Zeitstempeln, kontextuellen Erfassungen, Archiven, Datei-Hashes, Einschränkungen und sorgfältigen Zitaten.

Schnellantwort

Schnellantwort zu Wie man eine Webquelle archiviert und dokumentiert

Erfassen Sie die eingegebene und finale URL, die UTC-Abrufzeit, Titel, Autor, sichtbare Daten, die relevante Passage und den Quellenstandort. Speichern Sie kontextuelle Screenshots plus die Originaldatei oder eine umfassendere Seitendarstellung bei Bedarf, erstellen und verifizieren Sie ein unabhängiges Archiv und protokollieren Sie einen SHA-256-Digest für unveränderte lokale Dateien. Halten Sie Originale getrennt von Anmerkungen und geben Sie jede Erfassungslücke oder Transformation an.

  • Ein Screenshot allein bewahrt keine Weiterleitungen, Quellen-Metadaten, interaktiven Zustand oder genügend Kontext, damit eine andere Person den Befund reproduzieren kann.
  • Verifizieren Sie eine archivierte Seite nach der Erfassung, da Einzelseiten-Archive Skripte, Medien, erweiterte Abschnitte und verlinkte Dokumente übersehen können.
  • Ein übereinstimmender Hash unterstützt die Byte-Integrität seit der Aufzeichnung des Digests; er beweist nicht Urheberschaft, Authentizität, Zeit oder Wahrheit.

Themen: Web-Archivierung · Beweisdokumentation · Webarchive · Dateiintegrität

Ein Screenshot bewahrt Pixel. Er bewahrt nicht von sich aus die URL, Abrufzeit, Weiterleitungen, Seitenstruktur, herunterladbare Datei oder genügend Kontext, damit eine andere Person reproduzieren kann, was Sie gesehen haben.

Ein vertretbarer Webquellen-Datensatz ist ein kleines Beweisbündel: Quellen-Metadaten, kontextuelle Erfassungen, ein unabhängiges Archiv bei Bedarf, Integritätsinformationen für gespeicherte Dateien und ein Protokoll, das genau angibt, was jedes Element beweist.

Erfassen Sie die Quelle, bevor Sie sie analysieren

Beginnen Sie ein Beweisprotokoll, während die Live-Seite geöffnet ist. Erfassen Sie:

  • die eingegebene URL und die finale URL nach Weiterleitungen
  • Abrufdatum und -zeit mit Zeitzone, vorzugsweise UTC
  • Seitentitel, Website oder Herausgeber, namentlich genannter Autor und sichtbare Daten
  • die von der Seite deklarierte kanonische URL, falls verfügbar
  • die Behauptung oder Passage, die Sie archivieren, und wo sie erscheint
  • Links, Dokument-IDs, Video-IDs, Seitenzahlen oder Zeitstempel, die benötigt werden, um zur gleichen Stelle zurückzukehren
  • ob die Seite einen Login, ein Abonnement, eine Interaktion oder regionalen Zugang erforderte

Kopieren Sie den relevanten Text in Ihre Notizen, ohne Rechtschreibung oder Interpunktion stillschweigend zu korrigieren. Setzen Sie Auslassungen in eckige Klammern oder markieren Sie sie explizit. Behalten Sie genügend umgebenden Text bei, um zu zeigen, ob die Passage ein Zitat, eine Überschrift, eine Behauptung, eine Korrektur, eine Bildunterschrift oder eine Antwort auf jemand anderen ist.

Speichern Sie mehr als eine Darstellung

Kein einzelnes Format erfasst jede nützliche Eigenschaft. Für folgenreiche Recherchen erwägen Sie ein angemessenes Bündel:

  1. Kontext-Screenshot. Schliessen Sie die Adressleiste ein oder binden Sie das Bild anderweitig an die URL, plus Titel, relevante Passage und sichtbares Datum, wenn möglich.
  2. Ganzseitige Erfassung oder Druck-zu-PDF. Nützlich für Lesereihenfolge und breiteren Kontext, aber prüfen Sie es, da Druckstile Navigation, Kommentare, interaktive Diagramme oder erweiterten Text verbergen können.
  3. Original-herunterladbare Datei. Speichern Sie ein verlinktes PDF, Bild, Dataset oder Transkript wie geliefert; ersetzen Sie es nicht durch einen Screenshot der Datei.
  4. HTML- oder Webarchiv-Erfassung. Nützlich, wenn Links, Struktur oder Wiedergabe wichtig sind, aber skript-gerenderter Inhalt und externe Assets werden möglicherweise nicht sauber gespeichert.
  5. Notizen zur Interaktion. Erfassen Sie, welcher Tab, Filter, welche Offenlegung oder welcher Video-Zeitstempel den Beweis offengelegt hat.

Behalten Sie die erste gespeicherte Kopie unverändert. Wenn Sie zuschneiden, annotieren, schwärzen, transkodieren oder Text extrahieren, erstellen Sie eine Arbeitskopie und erfassen Sie die Transformation. Eine Anmerkung sollte niemals vom erfassten Original ununterscheidbar werden.

Erstellen Sie bei Bedarf ein unabhängiges Archiv

Ein Drittanbieter-Archiv kann eine stabile öffentliche Referenz unabhängig von Ihrem Gerät bieten.

Die Save Page Now-Funktion der Wayback Machine akzeptiert eine Seiten-URL und gibt eine permanente archivierte URL zurück, wenn das Speichern erfolgreich ist. Das Internet Archive erklärt, dass es die einzelne eingereichte Seite speichert, nicht die gesamte Website oder die von ihr verlinkten Seiten. Perma.cc erstellt ähnlich einen stabilen Datensatz für eine eingereichte Seite und rät Benutzern, den fertigen Datensatz zu überprüfen, um zu bestätigen, dass er korrekt angezeigt wird.

Nach der Archivierung:

  • öffnen Sie die archivierte URL in einem frischen Browser-Kontext
  • prüfen Sie, dass der relevante Text, das Bild, das Datum und das Layout vorhanden sind
  • testen Sie, ob ein eingebettetes Dokument, Audio, Video oder ein erweiterter Abschnitt überlebt hat
  • erfassen Sie die Archiv-URL und ihren Erfassungszeitstempel
  • bewahren Sie die Live-URL neben der Archiv-URL auf

Ein Archivierungsfehler ist kein Beweis dafür, dass eine Seite nie existiert hat. Login-Barrieren, Robots-Regeln, Skripte, Streaming-Medien, Ratenlimits und vorübergehende Fehler können alle eine vollständige Erfassung verhindern. Perma.cc dokumentiert auch, dass es die Zielseite bewahrt, anstatt rekursiv jede verlinkte Seite zu archivieren. Archivieren Sie jede wesentliche verlinkte Quelle separat.

Verwenden Sie keine neue Archiverfassung, um die Vergangenheit umzuschreiben. Sie beweist, was das Archiv zu diesem Zeitpunkt erfasst hat, nicht was die Seite gestern oder bei ihrer Erstveröffentlichung enthielt.

Erfassen Sie Dateiintegrität mit einem Hash

Berechnen Sie für lokal gespeicherte Dateien einen SHA-256-Digest und platzieren Sie ihn im Beweisprotokoll neben Dateiname, Grösse und Erfassungszeit. Der Secure Hash Standard von NIST spezifiziert SHA-256 unter den Algorithmen, die Message-Digests generieren, die verwendet werden, um zu erkennen, ob sich Daten seit der Generierung des Digests geändert haben.

Die Interpretation muss eng bleiben: Wenn dieselbe Datei später denselben Digest erzeugt, sind ihre Bytes relativ zur aufgezeichneten Kopie unverändert. Ein Hash beweist nicht, wer die Datei erstellt hat, ob die Live-Seite authentisch war, ob Ihre Computeruhr korrekt war oder ob der Inhalt wahr war.

Generieren Sie den Digest so bald wie praktikabel, halten Sie das Original schreibgeschützt, wenn Ihr Arbeitsablauf es erlaubt, und berechnen Sie einen neuen Digest für jede transformierte Kopie. Überschreiben Sie nicht den ursprünglichen Hash nach Bearbeitung einer Datei.

Verwenden Sie ein Beweisprotokoll, das eine andere Person prüfen kann

Eine Zeile pro Element ist einfacher zu verifizieren als ein Ordner mit unerklärten Screenshots:

FeldBeispiel für die Aufzeichnung
Beweis-IDWEB-2026-001
Live-QuelleExakte URL und finale weitergeleitete URL
AbrufISO-Datum, Zeit und Zeitzone
BeschreibungSeitentitel und die archivierte Behauptung oder Passage
DateienOriginal-Dateiname, Format, Byte-Grösse und SHA-256-Digest
ArchivStabile Archiv-URL und Erfassungszeitstempel
MethodeScreenshot, Druck-zu-PDF, Download, HTML-Speicherung oder Export
EinschränkungenFehlende Medien, Login erforderlich, gekürzter Text, dynamischer Zustand oder andere Lücke
ÄnderungenZuschnitt, Anmerkung, Schwärzung, OCR oder Konvertierung auf eine Kopie angewendet

Verwenden Sie konsistente Dateinamen, die nicht vom Gedächtnis abhängen, wie eine Beweis-ID, UTC-Datum, Domain und kurze Seitenbezeichnung. Halten Sie das Protokoll getrennt von den erfassten Dateien, damit es auch fehlende, beschädigte oder ersetzte Elemente beschreiben kann.

Für Team- oder Rechtsabläufe erfassen Sie, wer das Material erfasst, übertragen, geöffnet, kopiert oder transformiert hat und wann. Das erforderliche Chain-of-Custody-Verfahren hängt vom Forum und der Jurisdiktion ab; dieser Leitfaden ist Dokumentationspraxis, keine Rechtsberatung oder ein Versprechen der Zulässigkeit.

Zitieren Sie, was Sie tatsächlich archiviert haben

Ein nützliches Webzitat umfasst normalerweise den Autor oder die Organisation, Seitentitel, Veröffentlichungs- oder Aktualisierungsdatum, wenn unterstützt, Live-URL, archivierte URL und Ihr Abrufdatum. Fügen Sie eine Abschnittsüberschrift, Absatzbeschreibung, Seitenzahl oder Medien-Zeitstempel hinzu, damit Leser den relevanten Beweis finden können.

Zitieren Sie keine archivierte Homepage, wenn Ihre Behauptung aus einem verlinkten PDF stammte. Zitieren Sie keinen Suchergebnis-Snippet, wenn Sie die zugrunde liegende Seite geöffnet haben. Wenn sich Live- und archivierte Versionen unterscheiden, geben Sie an, welche Version die Aussage unterstützt, und bewahren Sie beide auf, wenn die Änderung wichtig ist.

Überprüfen Sie das Bündel erneut, bevor Sie sich darauf verlassen

Führen Sie einen kurzen Verifizierungsdurchgang durch:

  • kann eine andere Person das Archiv öffnen und die Passage lokalisieren?
  • zeigt der Screenshot genügend Quellenkontext?
  • stimmt die gespeicherte Datei noch mit ihrem aufgezeichneten Digest überein?
  • sind die Live- und finalen URLs unterschieden?
  • sind Veröffentlichungszeit, Abrufzeit und Archivzeit separat gekennzeichnet?
  • sind Lücken und Transformationen offengelegt?

Wenn eine Antwort nein ist, reparieren Sie den Datensatz, während die Quelle noch verfügbar ist, oder geben Sie die Einschränkung klar an.

Archivieren Sie verhältnismässig und rechtmässig

Öffentliche Verfügbarkeit ist keine pauschale Erlaubnis zur Wiederveröffentlichung. Urheberrechts-, Datenschutz-, Datenschutzgesetzes-, Gerichtsbeschluss- und vertragliche Beschränkungen können weiterhin gelten. Archivieren Sie nur, was Ihr legitimer Zweck erfordert, beschränken Sie den Zugang zu sensiblem Material und schwärzen Sie personenbezogene Daten aus Arbeits- oder geteilten Kopien, ohne das aufbewahrte Original zu verändern.

Erstellen Sie keine öffentlichen Archive von offengelegten Zugangsdaten, intimen Materialien, Daten von Kindern, privaten Kontaktdaten oder Informationen, deren Wiederveröffentlichung ein vorhersehbares Sicherheitsrisiko schaffen würde. Umgehen Sie keine Zugriffskontrollen. Wenn ein kurzes Zitat und ein zuverlässiges Zitat die Arbeit unterstützen, veröffentlichen Sie keine gesamte urheberrechtlich geschützte Seite erneut.

Wenn Sie ältere Zustände rekonstruieren müssen, verwenden Sie Wie man die früheste Version einer Webseite findet. Für eine Behauptung, die sich durch wiederholte Zitate verbreitet hat, fahren Sie fort mit Wie man ein Zitat zu seiner Originalquelle zurückverfolgt.

Wenden Sie diese Methode in einem Recherche-Workflow an

Verwenden Sie die DeepSearch Research-Übersicht, um einen Ausgangspunkt zu wählen, und folgen Sie dann dem Quellenvergleichs-Workflow. Öffentliche Leitfäden sind kostenlos; die Nutzung von Research erfordert bezahlten Zugang.

Weiterlesen