Du kopierar text från en låst hemsida genom att läsa de publika sidorna, så som en sökmotor gör, i stället för att logga in. Nyckeln är en enkel insikt: om du har förlorat åtkomsten till adminpanelen men sidan fortfarande visas för besökare, är allt som syns offentligt tillgängligt och går att hämta. En crawler går igenom sidorna, öppnar varje och sparar texten, bilderna och adresserna som filer, utan inloggning och utan åtkomst till databasen. För enstaka sidor räcker det att markera och kopiera i webbläsaren; för hela sajten behövs ett verktyg som gör det i batch. Du får bara det som är publikt synligt, inte utkast eller låst innehåll, men för att rädda en sajt du inte längre kommer in i är det oftast allt som räknas. WPBuildAI skannar de publika sidorna och returnerar texten, bilderna och adresserna som rena filer.
Det som syns är offentligt
Det lönar sig att börja med varför detta fungerar, för det vänder problemet. När du är utelåst tänker du på det du inte kommer åt: panelen, databasen, filerna. Men det du behöver, texten och bilderna, visas redan för varje besökare, och därmed för dig. En webbsida levereras som HTML till webbläsaren, så allt synligt innehåll är hämtbart utan inloggning. Du behöver alltså inte komma in i baksidan för att rädda framsidan. Den insikten flyttar fokus från att försöka återfå åtkomst, vilket kan ta tid, till att helt enkelt läsa det som redan är publikt, vilket går nu.
För enstaka sidor: markera och kopiera
Behöver du bara några sidor är det enklaste att markera och kopiera direkt i webbläsaren. Öppna sidan, markera texten, kopiera och klistra in i ett dokument, och spara bilderna genom att högerklicka. Det kräver ingen inloggning och inga verktyg, och för en handfull sidor är det snabbast. Begränsningen är att det blir tungt för många sidor och att formateringen ibland följer med rörigt. För ett par sidor är det ändå rätt val, men så fort det handlar om en hel sajt blir manuellt kopierande opraktiskt, och då går du över till nästa metod.
För hela sajten: en crawler i batch
För en hel låst sajt använder du en crawler som gör i batch det du annars skulle göra för hand. Den utgår från startsidan, följer varje länk, öppnar sidorna och sparar texten, bilderna och adresserna som filer. På så vis fångar den även sidor som inte ligger i menyn men fortfarande finns, samma metod som i extrahera WordPress-data utan Python. Om API:et råkar vara aktivt kan WordPress REST API också ge innehållet som JSON. Det här belastar inte servern hårt, eftersom det bara läser de publika sidorna, och det ger dig hela sajten som filer i stället för en sida i taget.
Vad du får (och inte får)
Det är ärligt att vara tydlig med gränsen. Du får allt som är publikt synligt: publicerade sidor och inlägg, deras text, bilder och adresser. Du får inte det som inte visas: utkast, schemalagt innehåll, sidor bakom lösenord, eller data som bara finns i databasen utan att synas, som vissa inställningar. För att rädda en låst sajt är det publika innehållet nästan alltid det som räknas, eftersom det är det som rankar och drar besökare, vilket Backlinkos analys pekar på. Web Almanac 2024 (HTTP Archive) påminner om hur mycket en sida bär i bilder, så ta med dem, inte bara texten.
Behåll adresser och metadata
När du räddar innehållet, ta med adresserna också, inte bara texten. Spara varje sidas URL tillsammans med innehållet, för den listan är vad du behöver för att bygga om sajten på samma adresser, som i lista alla URL:er. Behåller du adresserna när du bygger om någon annanstans, behåller sajten sina placeringar; ändras de, lägg en 301 från den gamla till den nya, enligt guiden om flytt med URL-ändringar och hur man gör en 301. Att rädda texten är halva jobbet; att veta vilken adress den hörde till är den andra halvan.
När sidan inte ens visas
Ibland är sajten inte bara låst utan helt nere, och då visas inget att läsa. Då finns ändå två vägar. Den första är en cachelagrad version: sökmotorers cache eller webbarkiv kan ha en kopia av sidorna som de såg ut, och därifrån kan texten räddas. Den andra är att be värden återställa sajten tillfälligt, även på en temporär adress, så länge att den kan läsas. Båda är sämre än en levande sajt, men de visar principen: så länge innehållet finns någonstans publikt, även i cache, går det att rädda. Är sajten helt borta utan cache, är en säkerhetskopia det enda kvar, vilket är skälet att alltid ha en.
Steg för steg
- Kontrollera att sajten fortfarande visas för besökare.
- Enstaka sidor: markera och kopiera i webbläsaren, spara bilderna.
- Hela sajten: kör en crawler som sparar text, bilder och adresser.
- Ta med adresserna tillsammans med innehållet.
- Bygg om någon annanstans, behåll adresserna eller lägg 301.
- Är sajten nere: prova cache eller webbarkiv, eller be värden återställa den.
Exempel: rädda texten från en låst sajt
Ta ett företag som blev utelåst från sin WordPress-panel efter en tvist med en tidigare utvecklare, men där sajten fortfarande visas. I stället för att vänta på återställd åtkomst läses de publika sidorna: en crawler går igenom sajten och sparar 70 sidor med text, bilder och adresser som rena filer. Utkast och inställningar går inte att få, men allt publicerat innehåll, det som drar besökare, räddas. Adresserna sparas med innehållet, så när sajten byggs om på en ny WordPress kan samma URL:er användas och placeringarna behållas. Företaget hade inte längre baksidan, men framsidan räckte för att rädda det som betydde något, ungefär som vid export av produkter utan full åtkomst.
Vanliga misstag
- Fokusera på att återfå åtkomst i stället för att läsa det som redan är publikt.
- Kopiera texten men glömma bilderna.
- Spara innehållet utan att notera vilken adress varje sida hörde till.
- Markera och kopiera för hand för en hel sajt, vilket blir ohållbart.
- Vänta tills sajten stängs av, då även det publika innehållet försvinner.
Att komma ihåg
Du kopierar text från en låst hemsida genom att läsa de publika sidorna, inte genom att logga in, för allt som visas för besökare är offentligt och hämtbart. För enstaka sidor räcker markera och kopiera; för hela sajten kör en crawler som sparar text, bilder och adresser som filer. Du får bara det publikt synliga, inte utkast eller låst data, men för att rädda en sajt du inte kommer in i är det oftast allt som räknas. Ta med adresserna så att du kan bygga om på samma URL:er, och agera medan sajten ännu visas, för stängs den av försvinner även det publika. WPBuildAI skannar de publika sidorna och returnerar texten, bilderna och adresserna som rena filer. Skicka adressen till din webbplats för en gratis analys.
Ingen koppling till WordPress, Lovable, Webflow, Shopify, Wix eller Squarespace.