Skip to content

Cómo encontrar la versión más antigua de una página web

Encuentra el estado archivado más antiguo de una página, prueba variantes de URL y redirecciones, y distingue la primera captura encontrada de la fecha real de publicación.

Respuesta rápida

Respuesta rápida a Cómo encontrar la versión más antigua de una página web

Registra la página actual, la URL final, la URL canónica y cualquier variante histórica respaldada. Verifica cada URL exacta en Wayback Machine, confirma la captura más antigua utilizable, luego busca en sitemaps antiguos, feeds, enlaces entrantes, redirecciones y un segundo índice de rastreo como Common Crawl. Describe el resultado como la fecha de captura o existencia verificada más antigua, no como la fecha real de publicación a menos que evidencia independiente la establezca.

  • Una marca de tiempo de archivo prueba que una versión capturada existía para ese momento; no prueba que la página se publicó por primera vez entonces.
  • Verifica variantes de URL justificadas y dominios predecesores porque las redirecciones y migraciones pueden ocultar capturas más antiguas.
  • Usa secuencias de capturas para establecer una ventana de cambio, y registra las URL archivadas exactas que la respaldan.

Temas: Archivos web · Wayback Machine · Fechas de publicación · Verificación de fuentes

La versión más antigua de una página web rara vez está en la URL actual. Las páginas se mueven, los dominios cambian, las redirecciones ocultan rutas antiguas y los archivos capturan solo algunos momentos. Una respuesta confiable por lo tanto necesita dos cosas: una búsqueda a través del historial de URL de la página y un registro de exactamente qué prueba la captura más antigua.

La regla central es simple: una marca de tiempo de archivo prueba que una versión fue capturada para ese momento. No prueba que la página se publicó por primera vez entonces.

Define la versión que estás tratando de encontrar

"Versión más antigua" puede significar:

  • la primera captura archivada de la URL exacta
  • la primera versión que contiene una afirmación, imagen, precio o política particular
  • la página antes de una corrección o rediseño posterior
  • la URL original antes de una migración o redirección
  • la evidencia más antigua de que la página existió en algún lugar

Escribe la pregunta. Si necesitas saber cuándo apareció una afirmación, la primera captura de la página puede ser irrelevante porque la afirmación pudo haberse agregado años después. Si necesitas el artículo original, una captura temprana de la página de inicio no es suficiente.

Registra la página actual y su familia de URL

Comienza con la página actual antes de abrir un archivo. Guarda:

  • la URL completa, incluyendo parámetros de consulta significativos
  • la URL final después de redirecciones
  • la URL canónica declarada por la página, si existe
  • el título visible, autor, fecha de publicación y fecha de última actualización
  • una oración distintiva del cuerpo
  • enlaces a versiones impresas, AMP, móviles, de idioma o sindicadas

Luego enumera variantes históricas plausibles respaldadas por lo que puedes ver:

  • http y https
  • www y sin www
  • dominios antiguos y actuales
  • un slug anterior revelado por una redirección
  • formas con barra diagonal final y páginas de índice
  • versiones impresas, AMP, móviles o basadas en consultas enlazadas por el sitio

No generes docenas de conjeturas aleatorias de URL. Sigue redirecciones, etiquetas canónicas, enlaces internos antiguos, sitemaps y entradas de feeds. Cada variante debe tener una razón para existir.

Verifica la URL exacta en Wayback Machine

Ingresa la URL completa en Wayback Machine y elige Browse History. Abre la captura disponible más antigua, luego verifica la página misma:

  1. ¿La dirección archivada contiene la URL que pretendías verificar?
  2. ¿El título de la página y el cuerpo coinciden con el tema?
  3. ¿La captura redirigió a una ruta o dominio diferente?
  4. ¿El contenido está lo suficientemente completo para respaldar tu conclusión?
  5. ¿Qué marca de tiempo de captura exacta aparece en la URL del archivo?

Registra la URL archivada estable, no solo el año mostrado en el calendario. Una captura puede contener imágenes faltantes, recursos reproducidos de fechas cercanas o una redirección en lugar del cuerpo de la página. El primer punto en un calendario es por lo tanto un candidato hasta que lo abras.

Repite la verificación para cada variante de URL justificada. Una migración de sitio puede hacer que la dirección actual parezca años más nueva que el mismo artículo en su dominio antiguo.

Compara capturas, no solo fechas

Abre la primera captura utilizable y las siguientes capturas alrededor de cualquier cambio importante. Compara los campos que importan para tu pregunta:

  • título y firma
  • fechas de publicación y actualización visibles
  • la afirmación o lenguaje de política central
  • imágenes, pies de foto y créditos
  • precios, nombres de productos o llamados a la acción
  • enlaces de fuentes salientes
  • URL canónica y redirecciones

Para un cambio consecuente, copia el pasaje relevante en tus notas y mantén la URL de captura junto a él. No digas "la página cambió en marzo" cuando todo lo que sabes es que una redacción aparece en una captura de febrero y otra en una captura de abril. El intervalo honesto es "después de la captura de febrero y para la captura de abril".

La cobertura de archivos suele ser escasa. El estándar de archivo web Memento permite explícitamente que la fecha archivada devuelta difiera significativamente de la fecha solicitada. Un día faltante no es evidencia de que la página no existió ese día.

Cuando la URL exacta no tiene captura útil

Trabaja hacia afuera en un orden controlado.

Verifica el listado de URL archivadas del sitio. Wayback Machine puede listar archivos que capturó bajo un dominio o ruta. Busca un slug más antiguo, directorio basado en fechas, página impresa, adjunto o página de índice que enlace al objetivo.

Inspecciona sitemaps y feeds antiguos. Los sitemaps XML archivados, feeds RSS, índices de autores, páginas de categorías y archivos de boletines a menudo preservan la URL y el título originales incluso cuando el artículo mismo no fue capturado.

Busca el título exacto o una oración rara. El texto citado puede revelar una copia sindicada, cita, enlace de foro o espejo de feed. Una página fechada independientemente que enlaza al objetivo prueba que el objetivo existía a más tardar en esa fecha, incluso si el objetivo no fue capturado.

Verifica otro índice web. Common Crawl proporciona un índice de URL CDX público a través de sus colecciones de rastreo. Busca la URL exacta o un patrón estrecho de URL. Un registro puede revelar que un rastreador vio una URL en un rastreo particular y puede proporcionar la ubicación de respuesta almacenada. Es una segunda fuente de cobertura, no prueba de que no existió una página anterior.

Sigue las redirecciones hacia atrás. Busca el dominio antiguo, título, página de autor y enlaces entrantes. Los mapas de migración a veces revelan la URL predecesora más claramente que el sitio actual.

Trata las fechas de página como afirmaciones a verificar

Una fecha "Publicado" visible, fecha de datos estructurados, encabezado HTTP Last-Modified o fecha dentro de una URL pueden ayudar, pero ninguna prueba la primera publicación por sí sola. Las migraciones de sistemas de gestión de contenido pueden restablecer campos. Los editores pueden retrofechar o corregirlos. Los servidores a menudo generan Last-Modified a partir del comportamiento de implementación o caché.

Prefiere el acuerdo independiente:

  • la fecha de publicación propia de la página
  • una captura de archivo en o poco después de esa fecha
  • una entrada de feed o sitemap fechada
  • un enlace contemporáneo de otro sitio
  • un índice de autor, edición o categoría que contenga la página

Si tres registros coinciden y nada anterior los contradice, puedes reportar una ventana de publicación bien respaldada. Mantén la evidencia adjunta a la conclusión.

Mantén un registro de evidencia

Una tabla pequeña evita que las fechas se conviertan en conjeturas:

EvidenciaMarca de tiempoQué pruebaLimitación
URL de página archivadaTiempo de capturaEsta versión existía para la capturaPudo haber existido antes
Entrada de feed fechadaFecha del feedEl sitio listó la URL para esta fechaLas fechas de feed pueden ser migradas
Enlace entrante independienteFecha de publicaciónOtra página se refirió a ella para esta fechaLa fecha de la página enlazante también necesita verificación
Metadatos de página actualFecha visible o de máquinaLo que el sitio actual afirmaPuede ser editada o restablecida

Para cada elemento, registra la URL exacta, marca de tiempo, título de página, texto relevante y la fecha en que accediste. Si el resultado importa legal o profesionalmente, conserva capturas de pantalla o archivos bajo las reglas de evidencia que apliquen a tu trabajo; no confíes en que una pestaña del navegador permanezca disponible.

Preserva la página actual sin reescribir la historia

Si la página en vivo es importante y no tiene captura actual, Save Page Now de Wayback Machine puede crear una. Internet Archive dice que esto guarda la página única ingresada y devuelve una URL permanente; no rastrea todo el sitio ni sus enlaces salientes.

Esa nueva captura preserva la página de ahora en adelante. No llena el vacío en el pasado, y nunca debe presentarse como evidencia de lo que la página contenía antes del tiempo de captura.

Establece la conclusión con precisión

Usa lenguaje que exponga la incertidumbre restante:

  • Versión archivada más antigua encontrada: la captura utilizable más antigua localizada para la familia de URL verificada.
  • Afirmación presente para: la primera captura en la que aparece el texto relevante.
  • Ventana de publicación: después de la última captura sin el contenido y para la primera captura con él.
  • Existencia verificada independientemente más antigua: un archivo, feed o enlace entrante establece que la página existía para esta fecha.
  • No resuelto: la cobertura de archivo o el historial de URL es insuficiente.

Nunca conviertas "el archivo no tiene nada anterior" en "no existió nada anterior". La protección con contraseña, exclusiones de rastreadores, páginas sin enlaces, contenido renderizado por scripts, fallas de rastreo, eliminaciones y simple mala suerte crean vacíos.

Si la página contiene una foto o video cuyo propio origen está en cuestión, continúa con cómo encontrar la fuente original de una foto o video.

Continuar leyendo