Descargas una página web completa con sus carpetas rastreándola: una herramienta visita todas las páginas públicas y guarda el HTML, las imágenes y los archivos en una estructura de carpetas que abres directamente en Windows o Mac, sin necesidad de un servidor. La clave es esa diferencia: no es lo mismo que una copia de la base de datos, que es un archivo ilegible salvo que lo cargues en WordPress. Para un sitio WordPress, el rastreo produce una copia legible del contenido y los medios, útil como respaldo, para consultar sin conexión o como punto de partida de una migración. WPBuildAI rastrea la URL y devuelve el contenido y los medios ordenados en carpetas.

La diferencia con una copia de la base de datos

Conviene distinguir dos cosas que suelen confundirse. Una copia de la base de datos (un volcado SQL) contiene tus contenidos, pero en un formato que solo otro WordPress puede leer: ábrela en tu ordenador y verás texto técnico, no tus páginas. Una descarga del sitio en carpetas, en cambio, guarda las páginas tal como se ven, en HTML, con las imágenes en sus carpetas, y la abres con un navegador o el explorador de archivos. La primera sirve para restaurar el mismo WordPress; la segunda, para leer, archivar o reconstruir en cualquier sitio. Para la mayoría de usos prácticos, la copia legible es la que quieres.

Qué incluye una descarga completa

Una descarga completa va más allá de la página de inicio. Incluye el HTML de todas las páginas y entradas, las imágenes con su texto alternativo, los archivos CSS y JavaScript que dan el aspecto, y la lista completa de URLs. El Web Almanac 2024 (HTTP Archive) recuerda cuánto contenido vive en un sitio WordPress, casi siempre más páginas de las que su dueño recuerda. Por eso una descarga útil parte de un rastreo completo, no solo de las páginas del menú, para que no falte nada.

Cómo se organiza en carpetas

La gracia de este método es que el resultado es navegable. Las páginas se guardan como archivos HTML que reproducen la estructura de URLs en carpetas, y las imágenes y archivos van en sus propias subcarpetas. Así, abrir la copia es como navegar el sitio en tu disco: cada página en su sitio, cada imagen donde le corresponde. Una estructura ordenada también facilita reutilizar el contenido después, porque encuentras cada pieza por su ruta. Es la diferencia entre un respaldo que puedes usar y uno que solo ocupa espacio.

Tres formas de descargar el sitio

Para una copia legible en carpetas, el rastreo del frontend es el camino directo.

Para qué sirve una copia legible

Saber el uso ayuda a decidir el formato. Como respaldo, una copia legible te deja consultar el contenido aunque el sitio caiga, sin depender de un servidor. Sin conexión, puedes leer o revisar el sitio en tu ordenador. Y como base de migración, el HTML y los medios descargados son el punto de partida para reconstruir en otra plataforma, conservando las URLs o redirigiéndolas con 301 según la guía de Google sobre el cambio de sitio con cambios de URL. La plataforma no posiciona, como halló el análisis de Backlinko; lo que cuenta es conservar el contenido y las URLs.

Lo que no se descarga

Una descarga del frontend captura lo público, no lo privado. Quedan fuera las páginas protegidas por contraseña, los datos de usuarios, los pedidos de una tienda y cualquier contenido no publicado, porque nada de eso aparece en las páginas visibles. Si necesitas esos datos, la vía es el acceso al backend o a la base de datos. Pero para archivar o reconstruir un sitio de contenidos, lo público (texto, imágenes, archivos y URLs) suele ser suficiente. Saber qué no entra evita esperar de la copia algo que no puede contener.

Paso a paso

  1. Reúne la lista de URLs desde el sitemap, los enlaces internos y Search Console.
  2. Rastrea el sitio completo, no solo las páginas del menú.
  3. Guarda el HTML, las imágenes y los archivos en su estructura de carpetas.
  4. Comprueba que el número de páginas coincide con el original.
  5. Archiva la copia en un lugar seguro.
  6. Si migras: usa la lista de URLs para las redirecciones 301.

Ejemplo: un sitio de 80 páginas

Tomemos un sitio de 80 páginas del que quieres una copia legible. Un rastreo encuentra las 80 páginas más unas 20 URLs de etiquetas y archivos que no estaban en el menú. La herramienta guarda cada página como HTML en su carpeta, con las imágenes en subcarpetas y su texto alternativo. Abres la carpeta en tu ordenador y navegas el sitio sin conexión, sin servidor. Compruebas que las 100 URLs están. Más tarde, esa misma copia sirve de base para reconstruir el sitio en otra plataforma, reutilizando el contenido y poniendo redirecciones donde las URLs cambian. Una copia que de verdad puedes usar, no un volcado ilegible.

Errores frecuentes

  • Confundir un volcado de la base de datos con una copia legible del sitio.
  • Rastrear solo las páginas del menú y dejar fuera etiquetas y archivos.
  • Guardar el texto y olvidar las imágenes y su texto alternativo.
  • Esperar datos privados o pedidos de una descarga del frontend.
  • Al migrar: no usar la lista de URLs para las redirecciones, y dejar 404.

Lo que conviene recordar

Descargas una web completa con sus carpetas rastreándola: una herramienta guarda el HTML, las imágenes y los archivos en una estructura de carpetas legible en cualquier ordenador, sin servidor. Es lo contrario de una copia de la base de datos, ilegible sin WordPress. Parte de un rastreo completo, no solo del menú, comprueba el número de páginas, y guárdala como respaldo, para consulta sin conexión o como base de migración. Lo privado queda fuera, pero el contenido público es lo que necesitas. WPBuildAI rastrea la URL y devuelve el contenido y los medios ordenados en carpetas. Envía la dirección de tu sitio y te hacemos un análisis gratuito.

Sin afiliación con WordPress, Lovable, Webflow, Shopify, Wix ni Squarespace.