Internet Archive Wayback Machine Link Fixer

Beschreibung

Internet Archive Wayback Machine Link Fixer ist ein WordPress-Plugin gegen den sogenannten Link Rot – den allmählichen Verfall von Web-Links durch Verschieben, Verändern oder Abschalten von Seiten. Es durchsucht automatisch den Inhalt deiner Beiträge – neu gespeicherte und bestehende –, um ausgehende Links zu erkennen. Für jeden dieser Links überprüft es die Wayback Machine des Internet Archives auf eine archivierte Version und erzeugt einen Snapshot, falls keiner verfügbar ist.

Wenn eine verlinkte Seite verschwindet, hilft das Plugin dabei, dein Nutzererlebnis zu erhalten, indem es die Besucher zu einer zuverlässigen archivierten Version umleitet. Es arbeitet auch proaktiv, indem es deine eigenen Beiträge bei jeder Aktualisierung archiviert und so ein konsistentes Backup des Verlaufs deiner Inhalte erstellt.

Schütze deine Links, bewahre deine Inhalte und automatisiere den Archivierungsprozess – alles mit minimalem Aufwand.

Hauptfunktionen

  • Scannt automatisch nach ausgehenden Links im Beitragsinhalt
  • Überprüft die Wayback Machine auf vorhandene Archive
  • Erstellt neue Schnappschüsse, wenn kein Archiv existiert
  • Leitet fehlerhafte oder fehlende Links auf archivierte Versionen weiter
  • Archiviert deine eigenen Beiträge bei Aktualisierungen
  • Funktioniert sowohl bei neuen als auch bei bestehenden Inhalten
  • Hilft, die Zuverlässigkeit von Inhalten und SEO langfristig zu erhalten

Externe Dienste

Dieses Plugin verbindet sich mit externen Diensten, die vom Internet Archive zur Verfügung gestellt werden, um seine Kernfunktionen bereitzustellen. Die folgenden Informationen zeigen, welche Daten wann und warum gesendet werden:

Internet Archive Wayback Machine API (web.archive.org)

Was der Service ist und wofür er genutzt wird:
Die Internet Archive Wayback Machine ist ein digitales Archiv des World Wide Web. Dieses Plugin nutzt dessen API, um nach vorhandenen archivierten Versionen von Webseiten zu suchen, neue Snapshots von Seiten zu erstellen und den Status von Archivierungsaufträgen zu überprüfen.

Welche Daten werden gesendet und wann:

  • System Status Check: Es werden keine persönlichen Daten gesendet. Wird verwendet, um zu überprüfen, ob der Wayback Machine-Dienst online ist.
  • User Account Validation: Wenn du einen API-Schlüssel konfigurierst, werden dein Zugangsschlüssel und dein geheimer Schlüssel im Autorisierungs-Header gesendet, um dein Konto zu validieren und Nutzungsstatistiken abzurufen (verfügbare Snapshots, Tageslimits usw.).
  • URL Archiving: URLs aus deinem Website-Inhalt werden gesendet, um neue Snapshots in der Wayback Machine zu erstellen. Dies gilt sowohl für externe Links in deinen Inhalten als auch für die URLs deiner eigenen Beiträge, wenn die automatische Archivierung aktiviert ist.
  • Snapshot Status Checks: Job-IDs werden gesendet, um den Status von Archivierungsanfragen zu überprüfen.
  • Existing Snapshot Lookups: URLs werden gesendet, um nach bestehenden archivierten Versionen von Webseiten zu suchen.

Nutzungsbedingungen und Datenschutzerklärung:

Internet Archive Bot API (iabot-api.archive.org)

Was der Dienst ist und wofür er verwendet wird:
Dieser Dienst prüft, ob Webseiten zugänglich sind und ruft die endgültigen URLs nach Weiterleitungen ab. Er wird verwendet, um festzustellen, ob Links defekt sind und durch archivierte Versionen ersetzt werden müssen.

Welche Daten werden gesendet und wann:

  • Link-Zugänglichkeits-Überprüfungen: URLs aus dem Inhalt deiner Website werden gesendet, um zu prüfen, ob sie zugänglich sind und um die endgültige Ziel-URL nach eventuellen Weiterleitungen zu erhalten.
  • Impersonation Parameter: Ein technischer Parameter (impersonate=1) wird gesendet, um das korrekte Verhalten der Link-Überprüfung sicherzustellen.

Nutzungsbedingungen und Datenschutzerklärung:

Datenaufbewahrung und Datenschutz:
Das Internet Archive ist eine gemeinnützige Organisation, die sich der Bewahrung digitaler Inhalte für den öffentlichen Zugang widmet. URLs, die an diese Dienste gesendet werden, werden Teil des öffentlichen Archivs und können über die Wayback Machine-Schnittstelle zugänglich sein. Außer den URLs selbst werden keine persönlichen Daten an diese Dienste übermittelt.

Entwickler-Dokumentation

Die Entwicklerdokumentation und den Quellcode findest du im GitHub-Repository: https://github.com/a8cteam51/internet-archive-wayback-machine-link-fixer

Screenshots

FAQ

Wie funktioniert der Link-Checker?

Dein Inhalt wird auf Links überprüft. Wenn es einen Link findet, prüft es, ob wir diesen Link schon einmal bearbeitet haben. Wenn nicht, wird ein Snapshot der Webseite im Internet Archive gefunden oder erstellt. Wenn die Zielseite dieses Links später offline geht, können wir den Link in die archivierte Version ändern.

Wie können wir feststellen, ob ein Link fehlerhaft ist?

Wir verwenden eine ähnliche Richtlinie wie Wikipedia. Wir überprüfen Links einmal wöchentlich. Nach 3 Fehlern in Folge betrachten wir einen Link als fehlerhaft, außer die Ziel-Website funktioniert wieder.

Können alle Links bearbeitet werden?

Leider nein, einige Websites erlauben es dem Internet Archive nicht, ihre Inhalte zu archivieren.

Werden meine eigenen Inhalte archiviert?

Ja, du kannst den Auto-Archivierer aktivieren. Dieser erzeugt jedes Mal neue Snapshots, wenn du etwas änderst.

Was passiert mit fehlerhaften Links?

Wenn wir einen fehlerhaften Link finden, aktualisieren wir die src on the fly. Der ursprüngliche Inhalt wird nicht bearbeitet und bleibt so, wie er erstellt wurde.

Wie lange dauert dies?

Das hängt primär davon ab, wie viel Links deine Inhalte enthalten. Alles läuft im Hintergrund, kann aber für eine Website mit Tausenden von Links viele Wochen dauern. Am besten läuft es als Tool, dass du einrichtest und dann im Hintergrund mitlaufen lässt.

Bedeutet dies eine Menge Overhead für meine Website?

Dies alles wird im Hintergrund in individuellen Tabellen verarbeitet; dies sollte keinen spürbaren Overhead für deine Website erzeugen.

Benötige ich einen API-Schlüssel von archive.org?

Auch wenn du keinen benötigst, erhöht er auf jeden Fall die Anzahl der Snapshots erheblich, die du an einem Tag erzeugen kannst.

Was passiert, wenn das Internet Archive offline geht?

Wenn die Dienste des Internet Archive offline gehen, verschiebt der Link-Fixer alle Prozesse um 24 Stunden und versucht es später erneut.

Wie oft werden meine eigenen Beiträge aktualisiert, wenn das automatische Archiv aktiv ist?

Bestehende Inhalte werden bei der Aktivierung des Plugins gesammelt an die Wayback Machine gesendet und dann alle 30 Tage erneut (standardmäßig, änderbar). Neue Inhalte werden kurz nach ihrer Veröffentlichung zur Archivierung gesendet. Aktualisierungen bestehender Inhalte lösen ebenfalls Aktualisierungen aus, die an die Wayback Machine gesendet werden.

Multisite-kompatibel?

Leider ist es derzeit noch nicht vollständig kompatibel. Die einzige Möglichkeit, es auf Multisite zu nutzen, besteht darin, es nur site- und nicht netzwerkweit zu aktivieren. Wir planen, dies in der nächsten Version zu beheben.

Wie sieht es mit Page-Builder-Plugins und individuellen Feldern aus?

Aktuell funktioniert das Plugin am besten mit dem Block-Editor von WordPress. Wir müssen noch einige Arbeiten erledigen, um Page-Builder-Plugins und individuelle Felder zu unterstützen.

Rezensionen

27. Mai 2026
Since November 2025, I’ve tested the Internet Archive Wayback Machine Link Fixer plugin against my custom command-line link checker. Here are my comments. Internet Archive Wayback Machine Link Fixer Positives Continuous link checking Standard WP administrator interface Negatives A high false positive rate means you need to manually verify every flagged link. For example, recently, I saw amazon.com flagged as a 404. Deal breaker. Automated replacements can unnecessarily replace links. To stop Link Fixer from redirecting to the Wayback Machine for amazon.com (and other good links), I needed to add a random query parameter (?t) to good links. Then I needed to exclude the original good link (that was flagged as a 404) and exclude the new ?t version on top of that (double work for every good link). Deal breaker. Poor interpretation of HTTP status codes and no way to tweak that. Deal breaker. Time sink from managing exclusions (no support for bulk action > exclude link) and doing workarounds for the false positives (see #2 above). High risk of replacing current content with outdated (sometimes totally ancient) archives. Poor visitor experience with unexpected link manipulation to Wayback Machine pages. At first, shocking and confusing, then annoying. Content quality degradation from linking to super old information instead of intelligently finding fresh and relevant pages. Real broken links (e.g., 404s) are not actually fixed in the HTML. So search bots will still see broken links (false sense of security). Dynamically replacing broken links does not help SEO. Google doesn’t guarantee crawling client-side rendering. Not geared towards human content editors. Shows all broken links across the entire site in one long list. No grouping by document or page. No context about which document contains which broken links. It’s not easy for content writers like me to navigate and fix links. The “Back to All Links” button is buggy. I expect to return to the main list of links. Instead, it acts like the browser back button. Example link for „Back to All Links“: admin.php?page=iawmlf-links&iawmlf_link_id=1401. On top of that, clicking „Back to All Links“ submits the last HTTP request (which can undo any edits without you knowing—gnarly). All Link Fixer admin pages show the same page title. That makes it difficult to navigate back to specific links using the browser history. In the screen capture attached, you cannot tell that the links are actually to different pages. Phantom (orphaned) links: Links remain in the checking queue even when they’re no longer present in any post or page. This creates wasted processing cycles. cluttered interface, and confusion about which links need attention. I needed to manually exclude each orphaned link, so at least I know which ones I can ignore. Custom code solution More control My custom solution is only semi-automated, but I define how to handle HTTP status codes and what my link replacements should be.   Real link fixing My broken links are “really” fixed when I edit my posts and pages (bonus: my edits update the “last modified” date). Search bots will see my real fixed links, and my “freshness” score gets a boost. Document-centric workflow My custom solution generates a report ordered by page. For each page with a 404 link, it lists the broken URL, the link text for that URL, and Claude Code suggestions for replacement candidates. Screen captures False positives: jumpshare dot com /share/VNPnKIoPF3khooUfnEO8 Same page title in browser history: jumpshare dot com /share/ADuvrhg7Xay2lzxv66QS Parting thoughts We’d definitely reconsider using this plugin if the major deal breakers are addressed. ☺️
26. Mai 2026 2 Antworten
While this is a great plugin on paper, it sadly does not seem to respect its own „Exclude this link“ settings. Additionally, it will sometimes report links that are fully online and functional as being down. Figured forcing „Exclude this link“ would resolve this, or at least make it so I can exclude links from being redirected. But no. It does nothing.
11. März 2026 1 Antwort
I love the idea of the plugin, but it has a major technical flaw. When activated, the blog’s frontend tries to load scripts and/or resources from the wp-admin directory, and I think this is something a plugin shouldn’t do. I protect wp-admin via htaccess as an additional measure against hackers, so my frontend threw some errors for ordinary users. I suggest fixing the plugin by moving frontend resources to wp-content. Otherwise a great project. Thank you Archive.org people for doing great work!
2. März 2026 1 Antwort
I had a very poor experience after installing the Internet Archive Wayback Machine Link Fixer plugin. Immediately after activation, my website became completely inaccessible. I could not open any page on the frontend, and the site showed errors or failed to load entirely. The only way to regain access was to log into the WordPress control panel and uninstall the plugin manually. As long as this plugin remained active, the site was unusable. This behavior is extremely risky, especially for live or business websites, as it can cause sudden downtime without any clear warning or recovery option. There was no proper error message, no fallback mechanism, and no indication of what caused the conflict. For a plugin that modifies links automatically, this level of instability is unacceptable. Because of this experience, I would strongly advise other users to avoid installing this plugin on a live site or to test it only in a staging environment first. In its current state, it feels unreliable and potentially harmful. Overall, this plugin caused more problems than it solved, and I cannot recommend it.
4. Dezember 2025
This has been working perfectly for me, and the only slight annoyance isn’t the plugin’s fault or even the Archive’s fault. Some sites block the Archive from archiving them, so they appear to the link checker as broken links too. Give a quick look through broken links on your Dashboard’s Posts section from time to time, as there might be a few you’ll need to add to the Link Exclusions under Advanced Settings. The benefits far outweigh the effort it takes to monitor that yourself. 🙂
Alle 8 Rezensionen lesen

Mitwirkende und Entwickler

„Internet Archive Wayback Machine Link Fixer“ ist Open-Source-Software. Folgende Menschen haben an diesem Plugin mitgewirkt:

Mitwirkende

„Internet Archive Wayback Machine Link Fixer“ wurde in 4 Sprachen übersetzt. Danke an die Übersetzer für ihre Mitwirkung.

Übersetze „Internet Archive Wayback Machine Link Fixer“ in deine Sprache.

Interessiert an der Entwicklung?

Durchstöbere den Code, sieh dir das SVN-Repository an oder abonniere das Entwicklungsprotokoll per RSS.

Änderungsprotokoll

1.4.2

  • Fix: Manually excluded links sometimes revert to unexcluded and can still be run through the link checker process. Now fully respects manual exclusions.

1.4.1

  • Fix: link data span now survives themes that wrap post content in wp_kses_post (previously the JSON could leak as visible text on category and archive templates).

1.4.0

  • Changes to how we store link information in posts, now uses an escaped <script> tag.
  • Move the frontend link checker from Ajax-driven to REST.
  • Improvements to link table queries for better memory usage.
  • Various small UI fixes.
  • Added optional link icon displayed next to fixed links on the frontend, with before/after positioning and third-party extensibility via the iawmlf_link_icons filter.

1.3.6

  • Allows posts to be selected to be excluded from link fixing and/or auto archiving.
  • Improves cleanup of passed attempts to create and verify snapshots
  • Adds an Archive.org donation notice.
  • Improves translatable strings for betting internationalisation.

1.3.5

  • Minor tweak to how we log errors in snapshot creation process.
  • Improvement on how link stats are generated.
  • Casts all archived urls to https://, can be disabled in settings.
  • Improvements to how we handle cancelled scan own post actions, to prevent flooding database with cancelled jobs.

1.3.4

  • Minor UI tweaks and changes
  • Default check intervals and total count of broken pages required to trigger redirection lowered.
  • Onboarding process streamlined.

1.3.3

  • Fixes bug where the links and scripts were loaded even if set to do nothing
  • Move to custom WP prefixed URLs
  • Fixes various issues with the dashboard icons and counts
  • Better handling of authentication issues and notices
  • Detect staging sites and prevent auto archiving from running.
  • Fixes bug where a missing auto archiving database option can result in posts still be indexed.

1.3.2

  • Bugfix

1.3.1

  • Nimmt verschiedene UI- und UX-Änderungen an Icons, Tooltipps und Beschriftungen vor.
  • Außerdem werden ein paar kleinere Fehler in den Einstellungen und im Assistenten behoben.

1.3.0

  • Erste öffentliche Freigabe.

Hinweis: Alle Versionen vor 1.3.0 wurden nicht öffentlich freigegeben.