Skip to content

Cómo encontrar la versión más antigua de una página web

Encuentra el estado archivado más antiguo de una página, comprueba variantes de URL y redirecciones, y distingue la primera captura encontrada de la fecha real de publicación.

Respuesta rápida

Respuesta rápida a Cómo encontrar la versión más antigua de una página web

Registra la página actual, la URL final, la URL canónica y cualquier variante histórica justificada. Comprueba cada URL exacta en Wayback Machine, verifica la captura más antigua utilizable, después busca en sitemaps antiguos, feeds, enlaces entrantes, redirecciones y un segundo índice de rastreo como Common Crawl. Describe el resultado como la fecha de captura o existencia verificada más antigua, no como la fecha real de publicación a menos que evidencia independiente la establezca.

  • Una marca de tiempo de archivo prueba que existía una versión capturada en ese momento; no prueba que la página se publicara por primera vez entonces.
  • Comprueba variantes de URL justificadas y dominios predecesores porque las redirecciones y migraciones pueden ocultar capturas más antiguas.
  • Utiliza secuencias de capturas para establecer una ventana de cambio, y registra las URL archivadas exactas que la respaldan.

Temas: Archivos web · Wayback Machine · Fechas de publicación · Verificación de fuentes

La versión más antigua de una página web rara vez está en la URL actual. Las páginas se mueven, los dominios cambian, las redirecciones ocultan rutas antiguas y los archivos capturan solo algunos momentos. Una respuesta fiable necesita por tanto dos cosas: una búsqueda a través del historial de URL de la página y un registro de exactamente qué prueba la captura más antigua.

La regla central es simple: una marca de tiempo de archivo prueba que una versión fue capturada en ese momento. No prueba que la página se publicara por primera vez entonces.

Define la versión que intentas encontrar

"Versión más antigua" puede significar:

  • la primera captura archivada de la URL exacta
  • la primera versión que contiene una afirmación, imagen, precio o política particular
  • la página antes de una corrección o rediseño posterior
  • la URL original antes de una migración o redirección
  • la evidencia más antigua de que la página existía en algún lugar

Escribe la pregunta. Si necesitas saber cuándo apareció una afirmación, la primera captura de la página puede ser irrelevante porque la afirmación podría haberse añadido años después. Si necesitas el artículo original, una captura temprana de la página de inicio no es suficiente.

Registra la página actual y su familia de URL

Comienza con la página actual antes de abrir un archivo. Guarda:

  • la URL completa, incluidos parámetros de consulta significativos
  • la URL final después de redirecciones
  • la URL canónica declarada por la página, si existe
  • el título visible, autor, fecha de publicación y fecha de última actualización
  • una frase distintiva del cuerpo
  • enlaces a versiones de impresión, AMP, móvil, idioma o sindicadas

Después enumera variantes históricas plausibles respaldadas por lo que puedes ver:

  • http y https
  • www y sin www
  • dominios antiguos y actuales
  • un slug anterior revelado por una redirección
  • formas con barra final y página índice
  • versiones de impresión, AMP, móvil o basadas en consultas enlazadas por el sitio

No generes docenas de conjeturas aleatorias de URL. Sigue redirecciones, etiquetas canónicas, enlaces internos antiguos, sitemaps y entradas de feeds. Cada variante debe tener una razón para existir.

Comprueba la URL exacta en Wayback Machine

Introduce la URL completa en Wayback Machine y elige Browse History. Abre la captura disponible más antigua, después verifica la página misma:

  1. ¿Contiene la dirección archivada la URL que pretendías comprobar?
  2. ¿Coinciden el título de la página y el cuerpo con el tema?
  3. ¿Redirigió la captura a una ruta o dominio diferente?
  4. ¿Es el contenido lo suficientemente completo para respaldar tu conclusión?
  5. ¿Qué marca de tiempo de captura exacta aparece en la URL del archivo?

Registra la URL archivada estable, no solo el año mostrado en el calendario. Una captura puede contener imágenes faltantes, recursos reproducidos de fechas cercanas o una redirección en lugar del cuerpo de la página. El primer punto en un calendario es por tanto un candidato hasta que lo abres.

Repite la comprobación para cada variante de URL justificada. Una migración de sitio puede hacer que la dirección actual parezca años más nueva que el mismo artículo en su dominio antiguo.

Compara capturas, no solo fechas

Abre la primera captura utilizable y las siguientes capturas alrededor de cualquier cambio importante. Compara los campos que importan para tu pregunta:

  • título y firma
  • fechas de publicación y actualización visibles
  • la afirmación o lenguaje de política central
  • imágenes, pies de foto y créditos
  • precios, nombres de productos o llamadas a la acción
  • enlaces de fuentes salientes
  • URL canónica y redirecciones

Para un cambio consecuente, copia el pasaje relevante en tus notas y mantén la URL de captura junto a él. No digas "la página cambió en marzo" cuando todo lo que sabes es que una redacción aparece en una captura de febrero y otra en una captura de abril. El intervalo honesto es "después de la captura de febrero y antes de la captura de abril".

La cobertura de archivo suele ser dispersa. El estándar de archivo web Memento permite explícitamente que la fecha archivada devuelta difiera significativamente de la fecha solicitada. Un día faltante no es evidencia de que la página no existiera ese día.

Cuando la URL exacta no tiene captura útil

Trabaja hacia afuera en un orden controlado.

Comprueba el listado de URL archivadas del sitio. Wayback Machine puede listar archivos que capturó bajo un dominio o ruta. Busca un slug más antiguo, directorio basado en fechas, página de impresión, adjunto o página índice que enlace al objetivo.

Inspecciona sitemaps y feeds antiguos. Los sitemaps XML archivados, feeds RSS, índices de autores, páginas de categorías y archivos de boletines a menudo preservan la URL y el título originales incluso cuando el artículo mismo no fue capturado.

Busca el título exacto o una frase rara. El texto entrecomillado puede revelar una copia sindicada, cita, enlace de foro o espejo de feed. Una página fechada independientemente que enlaza al objetivo prueba que el objetivo existía a más tardar en esa fecha, incluso si el objetivo no fue capturado.

Comprueba otro índice web. Common Crawl proporciona un índice de URL CDX público a través de sus colecciones de rastreo. Busca la URL exacta o un patrón de URL estrecho. Un registro puede revelar que un rastreador vio una URL en un rastreo particular y puede proporcionar la ubicación de respuesta almacenada. Es una segunda fuente de cobertura, no prueba de que no existiera ninguna página anterior.

Sigue las redirecciones hacia atrás. Busca el dominio antiguo, título, página de autor y enlaces entrantes. Los mapas de migración a veces revelan la URL predecesora más claramente que el sitio actual.

Trata las fechas de página como afirmaciones a verificar

Una fecha "Publicado" visible, fecha de datos estructurados, encabezado HTTP Last-Modified o fecha dentro de una URL pueden ayudar, pero ninguna prueba la primera publicación por sí sola. Las migraciones de sistemas de gestión de contenidos pueden restablecer campos. Los editores pueden retrofechar o corregirlos. Los servidores a menudo generan Last-Modified a partir del comportamiento de despliegue o caché.

Prefiere el acuerdo independiente:

  • la propia fecha de publicación de la página
  • una captura de archivo en o poco después de esa fecha
  • una entrada de feed o sitemap fechada
  • un enlace contemporáneo desde otro sitio
  • un índice de autor, número o categoría que contenga la página

Si tres registros coinciden y nada anterior los contradice, puedes informar una ventana de publicación bien respaldada. Mantén la evidencia adjunta a la conclusión.

Mantén un registro de evidencia

Una tabla pequeña evita que las fechas se conviertan en conjeturas:

EvidenciaMarca de tiempoQué pruebaLimitación
URL de página archivadaTiempo de capturaEsta versión existía en el momento de la capturaPuede haber existido antes
Entrada de feed fechadaFecha del feedEl sitio listó la URL en esta fechaLas fechas de feed pueden ser migradas
Enlace entrante independienteFecha de publicaciónOtra página se refirió a ella en esta fechaLa fecha de la página enlazante también necesita comprobación
Metadatos de página actualFecha visible o automáticaLo que afirma el sitio actualPuede ser editada o restablecida

Para cada elemento, registra la URL exacta, marca de tiempo, título de página, texto relevante y la fecha en que accediste. Si el resultado importa legal o profesionalmente, conserva capturas de pantalla o archivos bajo las reglas de evidencia que se aplican a tu trabajo; no confíes en que una pestaña del navegador permanezca disponible.

Preserva la página actual sin reescribir la historia

Si la página en vivo es importante y no tiene captura actual, Save Page Now de Wayback Machine puede crear una. Internet Archive indica que esto guarda la página única introducida y devuelve una URL permanente; no rastrea todo el sitio ni sus enlaces salientes.

Esa nueva captura preserva la página de ahora en adelante. No llena el vacío en el pasado, y nunca debe presentarse como evidencia de lo que la página contenía antes del tiempo de captura.

Expresa la conclusión con precisión

Utiliza lenguaje que exponga la incertidumbre restante:

  • Versión archivada más antigua encontrada: la captura utilizable más antigua localizada para la familia de URL comprobada.
  • Afirmación presente antes de: la primera captura en la que aparece el texto relevante.
  • Ventana de publicación: después de la última captura sin el contenido y antes de la primera captura con él.
  • Existencia verificada independientemente más antigua: un archivo, feed o enlace entrante establece que la página existía en esta fecha.
  • Sin resolver: la cobertura de archivo o el historial de URL son insuficientes.

Nunca conviertas "el archivo no tiene nada anterior" en "no existió nada anterior". La protección por contraseña, exclusiones de rastreadores, páginas sin enlazar, contenido renderizado por scripts, fallos de rastreo, eliminaciones y simple mala suerte crean todos vacíos.

Si la página contiene una foto o vídeo cuyo propio origen está en cuestión, continúa con cómo encontrar la fuente original de una foto o vídeo.

Continuar leyendo