Zum Inhalt springen

Links extrahieren

Alle Links einer Seite mit Ankertext und Attributen auslesen und exportieren.

Seiten-URL eingeben, um alle Links der Seite aufzulisten.
Wir rufen die öffentliche Seite für Sie ab; es wird nichts gespeichert.

So funktioniert’s

  1. Geben Sie im Tab „URL“ die Seiten-URL ein und klicken Sie auf „Links extrahieren“. Alternativ wechseln Sie zu „HTML einfügen“ und fügen den Quelltext der Seite ein; für relative Links können Sie optional eine Basis-URL angeben.
  2. Lassen Sie „Duplikate gruppieren“ aktiviert, um mehrfach vorkommende URLs zu einer Zeile zusammenzufassen; die Spalte „Anzahl“ zeigt, wie oft die URL vorkommt.
  3. Aktivieren Sie bei Bedarf „Subdomains als intern zählen“, um etwa blog.beispiel.de derselben Website zuzuordnen.
  4. Suchen Sie in den Ergebnissen nach einer URL oder einem Ankertext.

Beispiele

Kommentar- und Werbelinks prüfen

Eingabe
<a href="/ratgeber/">Zum Ratgeber</a>
<a href="https://www.bergshop.de/rucksaecke/" rel="sponsored noopener" target="_blank">Rucksäcke beim Werbepartner</a>
<a href="https://www.wanderblog.de/touren/" rel="ugc nofollow">Tourentipp aus den Kommentaren</a>
<a href="/kontakt/" target="_blank">Kontakt</a>
Ausgabe
Links gesamt 4 · Eindeutige URLs 4 · Intern 2 · Extern 2 · Nofollow 1 · UGC 1 · Sponsored 1 · Probleme 1
https://www.wanderfreunde.de/ratgeber/ — Zum Ratgeber — Intern
https://www.bergshop.de/rucksaecke/ — Rucksäcke beim Werbepartner — Extern · sponsored · noopener
https://www.wanderblog.de/touren/ — Tourentipp aus den Kommentaren — Extern · ugc · nofollow
https://www.wanderfreunde.de/kontakt/ — Kontakt — Intern

Unterseiten und Subdomains zusammenfassen

Eingabe
<a href="/service/versand/#kosten">Versandkosten</a>
<a href="/service/versand/#lieferzeit">Lieferzeit</a>
<a href="https://blog.radladen.de/pflegetipps/">Pflegetipps im Blog</a>
<a href="#groessentabelle">Zur Größentabelle</a>
Ausgabe
Links gesamt 3 · Eindeutige URLs 3 · Intern 3
https://www.radladen.de/service/versand/ — Versandkosten +1 weitere — Intern · ×2
https://blog.radladen.de/pflegetipps/ — Pflegetipps im Blog — Intern

Häufige Fragen

Kann ich alle Links einer Website extrahieren?

Das Tool liest jeweils eine einzelne Webseite oder den eingefügten HTML-Quelltext aus. Es durchsucht keine weiteren Unterseiten und crawlt nicht die gesamte Website.

Warum fehlen Links, die auf der Webseite sichtbar sind?

Links, die erst durch JavaScript entstehen, stehen nicht im ausgewerteten Quelltext. Im URL-Modus werden Seiten außerdem nach 5 MB abgeschnitten; Links dahinter fehlen.

Wie werden relative Links wie /kontakt/ aufgelöst?

Ein base-Element im HTML hat Vorrang. Andernfalls nutzt das Tool die abgerufene Seiten-URL oder beim eingefügten HTML die optional angegebene Basis-URL; ohne Basis bleiben relative Links relativ.

Kann ich die extrahierten Links in Excel weiterverarbeiten?

Der CSV-Export enthält unter anderem URL, Ankertext, Linktyp, rel-Attribute und Anzahl. Sie können entweder die gefilterten Ergebnisse oder alle Ergebniszeilen exportieren; die Datei verwendet UTF-8 mit BOM.

Wird mein HTML-Quelltext hochgeladen?

Eingefügtes HTML wird ausschließlich in Ihrem Browser verarbeitet und nicht hochgeladen. Bei einer URL-Eingabe ruft der Server die Seite ab; der Seiteninhalt wird weder zwischengespeichert noch gespeichert.