Skip to content
Live-Check · ruft deine URL server-seitig ab

Link Extractor

Extrahieren Sie alle <a href> aus einer Seite — Ankertexte, interne vs. externe Links, rel und target — in einem Klick.

Ein Link-Extractor analysiert den HTML-Code einer Seite serverseitig, durchläuft jedes <a href> Element und gibt eine strukturierte Tabelle von Links mit Ankertext, rel-Attributen, target und einer Klassifizierung für intern vs. extern zurück. Dieses Tool ist für SEO-Audits konzipiert, nicht für Text-Scraping. Füge eine URL ein, wähle einen Filter und erhalte jeden Link, den die Seite gegenüber Crawlern offenlegt. Du siehst, was Google sieht – mit nofollow-Flaggen, mailto- und tel-Handlern, Anker-Sprüngen und leeren Ankern, die alle gekennzeichnet sind, damit du sie beheben kannst.

Generate the whole content, not just check it.

BlazeHive writes SEO articles end to end from a single keyword. Outline, draft, meta, schema, internal links. Free trial, no card.

Start with BlazeHive Free trial

Was dieser Link-Extractor zurückgibt

Die Ausgabe ist eine Zeile pro <a href> auf der Seite. Jede Zeile enthält die Ziel-URL, den sichtbaren Ankertext, das rel-Attribut (mit nofollow, sponsored, ugc und noopener gekennzeichnet), den target-Wert und eine Typ-Spalte: internal, external, anchor, mailto oder tel. Eine typische 300-Link-Blog-Startseite verteilt sich auf 70% intern, 25% extern, 5% Anker oder mailto. Das Dropdown-Filterfeld reduziert die Ansicht auf einen Bereich. Diese Struktur ist es, was sie von einem Regex-über-Text-URL-Puller unterscheidet. Du erhältst den vollständigen DOM-Kontext für jeden Link, nicht nur die URL-Zeichenkette.

Wie du diesen Link-Extractor verwendest

  1. Seiten-URL eingeben. Füge die vollständige URL einschließlich https:// ein. Das Tool ruft die Seite serverseitig ab, daher muss die URL öffentlich erreichbar sein. Seiten hinter Login oder strengen Bot-Blöcken geben einen Abruffehler zurück.
  2. „Show" auswählen. Wähle einen von fünf Filtern: All links, Internal only, External only, Nofollow only oder Empty anchor text only. Standard ist All. Wechsle zu Internal only für Seitenstruktur-Audits, External only für Outbound-Überprüfungen, Nofollow only beim Überprüfen von Sponsored-Tagging.
  3. „Extract links" klicken. Das Tool gibt eine Tabelle innerhalb von 2-4 Sekunden zurück. In die Zwischenablage kopieren oder als CSV herunterladen.

Versuche das mit einer Blog-Startseite. Gib eine URL ein, lass Show auf All links. Du siehst 124 Zeilen: 87 intern, 31 extern, 6 Anker-Sprünge. Wechsle zu Empty anchor text only und 4 Zeilen tauchen auf, alles Logo-Wrapper und Icon-Links. Das sind die, die du zuerst behebst, denn Crawler und Screen Reader kennzeichnen beide leere Anker. Verwende den url-extractor, wenn du nur rohe URLs aus Text oder Markdown ohne HTML-Kontext brauchst.

Warum Ankertext und rel-Attribute für SEO wichtig sind

Ankertext sagt Suchmaschinen, worum es auf der verlinkten Seite geht. Ein Link mit Ankertext „kostenloses SEO-Audit-Tool" vermittelt mehr thematische Relevanz als einer mit Ankertext „hier klicken". Seiten mit 80% generischem Ankertext („mehr lesen", „hier", „das") rangieren durchschnittlich 5-8 Positionen niedriger als Seiten mit aussagekräftigen internen Ankern, laut Ahrefs-Studien von 1,2 Millionen SERPs.

rel-Attribute ändern, wie Link-Equity fließt. rel="nofollow" sagt Google, den Link für das Ranking zu ignorieren. rel="sponsored" kennzeichnet bezahlte Platzierungen. rel="ugc" kennzeichnet nutzergenerierte Comment-Links. Missbrauch (internen Links nofollow hinzufügen, vergessen, Sponsored-Content zu markieren) leckt entweder Budget oder riskiert eine manuelle Maßnahme. Dieser Extractor zeigt jeden rel-Wert an, damit du einen nofollow auf einen Navigations-Link in Sekunden entdeckst. Verbinde ihn mit dem canonical-checker, um zu überprüfen, dass die verlinkten Seiten das richtige kanonische Signal senden.

Häufige Fehler

  • Es als JavaScript-Scraper behandeln. Das Tool ruft rohes HTML ab. Wenn eine Seite Links über Client-Side React oder Vue rendert, erscheinen diese Links nicht, wenn sie nicht in der initialen Server-Response vorhanden sind. Verwende den google-crawler-simulator für JS-gerenderter Seiten.
  • Leere Anker-Zeilen ignorieren. Ein leerer Anker bedeutet normalerweise einen nur-Icon-Link ohne aria-label oder alt-Fallback. Crawler sehen keinen Kontext, Screen Reader geben nichts aus.
  • nofollow mit noindex verwechseln. Nofollow steuert Link-Equity-Fluss bei einem einzelnen Link. Noindex steuert, ob die Zielseite selbst rankt.
  • Nur eine Seite auditieren. Eine Startseite zeigt 100 Links, aber der echte Link-Graph entsteht über 50-100 Seiten. Führe den Extractor auf Top-Templates aus (Startseite, Blog-Hub, Kategorie, Produkt).
  • Den External + Nofollow-Filter bei Gast-Beiträgen überspringen. Wenn du Sponsored-Content akzeptierst, bestätigt die Kombination, dass dein Sponsored-Tagging konsistent ist.

Fortgeschrittene Tipps

  • Führe für interne Link-Audits den Extractor auf deinen Top-20 organischen Landingpages aus und überprüfe, ob jede 3-8 kontextuelle interne Links zu Revenue-Pages hat. Seiten mit unter 3 internen Links werden weniger oft gecrawlt und verlieren 15-25% der potenziellen Link-Equity.
  • Cross-referenziere die Ausgabe mit dem url-extractor, wenn du einen Markdown-Export hast. Die HTML-Version zeigt nofollow und rel an; die Regex-Version erfasst Links in Code-Blöcken, die die HTML-Version überspringt.
  • Verwende Empty anchor text only als schnelles Accessibility-Audit. WCAG 2.2 schlägt jeden Link ohne einen erreichbaren Namen fehl. Eine 5%+ Empty-Anchor-Rate signalisiert einen Defekt.
  • Nachdem du externe Links extrahiert hast, füge sie in einen Bulk-Status-Checker ein, um 404er zu erfassen. Ziele auf unter 1% kaputte externe Links über Top-Pages.
  • Vergleiche Verhältnisse mit Konkurrenten. Seiten, die auf Seite eins für kommerzielle Keywords ranken, haben durchschnittlich 12-18% externe Links und 82-88% interne. Über 30% extern leckt normalerweise Autorität.

Sobald du ein sauberes Link-Audit hast, überprüfe, dass die verlinkten Seiten konsistente Signale senden. Führe jedes eindeutige Ziel durch den canonical-checker, um Selbst-Kanonisierung zu bestätigen, und den google-crawler-simulator, um zu sehen, wie Googlebot sie rendert. Für Bulk-URL-Inventar aus Text-Dumps handhabt der url-extractor Paste-Eingaben, die der Link-Extractor nicht akzeptiert.

Generate the whole content, not just check it.

BlazeHive writes SEO articles end to end from a single keyword. Outline, draft, meta, schema, internal links. Free trial, no card.

Start with BlazeHive Free trial

Häufig gestellte Fragen

Was ist ein Link-Extractor?

Ein Link-Extractor ruft das HTML einer Webseite ab und gibt eine strukturierte Liste aller <a href> Elemente darauf zurück. Die Ausgabe enthält Ziel-URL, Ankertext, rel-Attribut, target und ob der Link intern oder extern ist. SEOs verwenden es, um interne Link-Struktur zu auditieren, fehlende nofollow-Tags auf Sponsored-Content zu finden und zu überprüfen, dass Ankertext aussagekräftig statt generisch ist. Eine typische Content-Seite exponiert 30-150 Links. Ohne Tool bedeutet Auditieren von Hand, jeden Rechtsklick auf jedem zu machen. Mit diesem Extractor fügst du eine URL ein und erhältst eine sortierbare Tabelle in Sekunden. Filtere das Ergebnis nach Internal, External, Nofollow oder Empty anchor, um dich auf einen Bereich zu konzentrieren. Verwende den url-extractor, wenn du nur URLs ohne HTML-Attribut-Kontext brauchst.

Wie extrahiere ich alle Links von einer Website?

Um jeden Link von einer einzelnen Seite zu extrahieren, füge die URL ein und klicke auf Extract links. Das Ergebnis zeigt jeden <a href> mit Ankertext, rel und interner vs. externer Klassifizierung, bereit zum Kopieren oder Herunterladen als CSV. Um Links von einer gesamten Website zu extrahieren, führst du das Tool entweder gegen jede Seite einzeln aus, verwendest einen Crawler wie Screaming Frog oder holst URLs zuerst aus der XML-Sitemap der Website und verarbeitest jede. Für eine 500-Seiten-Website zeigt Sitemap-Extraktion plus Per-Seiten-Link-Audits auf den Top-20-Templates 95% der strukturellen Link-Probleme auf. Beginne mit der Startseite, Blog-Hub und Top-Traffic-Landing-Pages. Der url-extractor akzeptiert Bulk-Text-Paste, wenn du bereits eine Liste von Seiten zum Verarbeiten hast. Für automatisierte Audits plant die gleichen 20 Templates monatlich und diffest die Link-Zählungen, um stille Navigationsänderungen zu erfassen.

Was ist der Unterschied zwischen einem Link-Extractor und einem URL-Extractor?

Ein Link-Extractor analysiert HTML und durchläuft <a href> Elemente, gibt Ankertext, rel-Attribute, target und Link-Typ (intern, extern, Anker, mailto) zurück. Ein URL-Extractor führt eine Regex über Text oder Markdown aus und zieht jeden URL-String, den er findet, unabhängig davon, ob diese URL ein anklickbarer Link, eine Code-Referenz oder ein Kommentar ist. Der Link-Extractor ist für SEO-Audits gebaut, wo rel und Anker wichtig sind. Der URL-Extractor ist für Bulk-URL-Inventar gebaut, wie das Bereinigen eines Markdown-Exports oder das Extrahieren von Links aus einem Slack-Archiv. Verwende dieses Tool, wenn du DOM-Level-Kontext für ein Audit brauchst. Verwende den url-extractor, wenn du einen Text-Blob hast und nur eine deduplizierte URL-Liste brauchst. Beide können auf der gleichen Quelle laufen: extrahiere Links hier, füge dann die Ziele in den URL-Extractor für weitere Dedupe und Normalisierung über mehrere Seiten ein.

Wie wirkt sich Ankertext auf SEO-Rankings aus?

Ankertext sagt Suchmaschinen, worum es auf der verlinkten Seite geht. Aussagekräftige Anker („kostenlosen CTR-Rechner") vermitteln thematische Relevanz. Generische Anker („hier klicken", „mehr lesen") vermitteln fast keine. Googles Link-Evaluierungssysteme gewichten aussagekräftige Anker 3-5x schwerer als generische für interne Link-Signale. Seiten mit 70%+ aussagekräftigen internen Ankern ranken durchschnittlich 6 Positionen höher als Seiten mit meist generischen Ankern, laut einer 2024er-Analyse von Ahrefs von 1,2 Millionen SERPs. Die Lösung: Auditiere deine Top-20 internen Landing-Pages, liste die eingehenden Anker auf und schreibe generische um, um das primäre Keyword der Zielseite in natürlicher Form zu enthalten. Vermeide Exact-Match-Stuffing auf jedem Link. Ziele auf Variation: Keyword, Partial-Match, Branded, aussagekräftige Phrase. Eine saubere Verteilung schlägt einen optimierten Anker, der 50 Mal über die Website wiederholt wird.

Was macht rel="nofollow" auf einem Link?

Das rel="nofollow" Attribut sagt Suchmaschinen, Ranking-Signale nicht durch diesen Link zu leiten. Google führte es 2005 ein, um Comment-Spam zu bekämpfen. Heute behandelt Google nofollow eher als Hinweis als strikte Direktive, aber die meisten anderen Suchmaschinen respektieren es weiterhin als harte Regel. Verwende nofollow auf nutzergeneriertem Inhalt (Forum-Beiträge, Blog-Kommentare), nicht vertrauenswürdigen externen Links und Login- oder Admin-Seiten. Verwende es nicht auf interner Navigation, Footer-Links oder deinen eigenen kontextuellen Outbound-Links zu autoritativen Quellen. Eine typische 100-Link-Seite sollte unter 5% nofollow interne Links haben. Dieses Extractors Nofollow only-Filter zeigt jeden nofollow-Link in Sekunden an, damit du Missbrauch ohne Scannen der gesamten Tabelle entdeckst. Für Sponsored oder bezahlte Links verwende rel="sponsored". Für Benutzer-Kommentare verwende rel="ugc". Korrekte Verwendung aller drei hält dich konform mit Googles Link-Attribut-Richtlinie von 2019.

Kann ein Link-Extractor Links von JavaScript-gerenderten Seiten extrahieren?

Dieses Tool ruft rohes HTML ab, was bedeutet, dass es nur die in der initialen Server-Response vorhandenen Links sieht. JavaScript-gerenderter Seiten (React, Vue, Angular SPAs ohne Server-Side-Rendering) injizieren Links oft nach dem Laden in das DOM. Diese Links erscheinen nicht, wenn das Framework sie auch nicht Server-Side pre-rendert. Um JS-gerenderter Link-Strukturen zu auditieren, brauchst du ein Tool, das einen Headless-Browser ausführt und auf die Seite wartet, bis sie hydratisiert. Der google-crawler-simulator rendert Seiten wie Googlebot, einschließlich JavaScript-Ausführung, und zeigt Post-Render-Link-Inventar an. Etwa 35% moderner Websites mischen Server-gerenderte und Client-gerenderter Links, daher kann ein HTML-nur-Extractor 10-40% Links auf diesen Seiten verpassen. Wenn dein CMS WordPress, Strapi, Astro oder Next.js mit SSR ist, erfasst der Link-Extractor alles.

Wie extrahiere ich Ankertext von einer Website?

Füge die Seiten-URL in den Link-Extractor ein und klicke auf Extract links. Die Anchor-Spalte zeigt den sichtbaren Text in jedem <a> Tag, einschließlich Text in verschachtelten <span> oder <strong> Elementen. Für Bild-Links (ein <img> in einem <a>), gibt der Extractor den alt-Text des Bildes als Anker zurück, wenn vorhanden, oder kennzeichnet die Zeile als Empty anchor text, wenn alt fehlt. Um Ankertext-Muster in Maßstab zu auditieren, exportiere das Ergebnis als CSV und führe eine Häufigkeitszählung in Excel oder Google Sheets aus. Eine gesunde Ankertext-Verteilung zeigt Variation: 40-60% aussagekräftig, 15-25% Branded, 10-20% Partial-Keyword-Match, unter 10% generisch. Alles über 30% generischer Ankertext signalisiert eine interne Linking-Lücke. Wiederhole das Audit auf deinen Top-10-Traffic-Pages alle drei Monate, um Drift zu erfassen, während neue Inhalte Links hinzufügen.

Was ist ein Internal-Link-Checker?

Ein Internal-Link-Checker audiert die Links, die von einer Seite auf andere Seiten auf der gleichen Domain zeigen. Er zeigt Waisen-Seiten, kaputte interne Links, fehlende kontextuelle Links und über-optimierte Ankertext. Dieser Link-Extractor verdoppelt sich als Internal-Link-Checker, wenn du den Show-Filter auf Internal only wechselst. Jede Zeile zeigt Ziel-URL, Ankertext und rel. Um Waisen-Seiten zu finden (Seiten mit null eingehenden internen Links), cross-referenziere die Extractor-Ausgabe über deine Top-20-Templates gegen deine Sitemap. Seiten in der Sitemap aber nicht in der eingehenden Link-Map sind Waisen. Eine typische Website hat 5-15% Waisen-Rate nach einem Jahr organischen Content-Wachstum. Führe den Extractor auf deine Startseite, Blog-Hub und Top-Category-Pages monatlich aus, um Waisen zu erfassen, bevor sie Rankings verlieren.

Wie finde ich externe Links auf einer Seite?

Füge die Seiten-URL ein und wechsle den Show-Filter auf External only. Die Ausgabe bricht zu jedem Link zusammen, der Off-Domain zeigt. Die Typ-Spalte bestätigt jede Zeile als extern. Die Rel-Spalte zeigt, ob der Link nofollow, sponsored oder ugc-Tags trägt. Die Target-Spalte zeigt, ob der Link in einem neuen Tab öffnet. Ein typischer Content-Artikel enthält 3-8 externe Links. Weniger als 3 sieht unter-zitiert aus (Googles Helpful-Content-Systeme gewichten externe Zitate als Qualitätssignal). Mehr als 15 beginnt wie eine Link-Farm auszusehen, wenn du kein kuratierter Ressource-Seite bist. Nachdem du externe Links extrahiert hast, füge sie in einen Bulk-Status-Checker ein, um 404er zu erfassen. Outbound-404er auf Top-Pages untergraben Benutzer-Vertrauen und verschwenden Crawl-Budget. Ziele auf unter 1% kaputte externe Links über deine Top-Traffic-Pages.

Warum gibt mein Link-Extractor weniger Links zurück als ich auf der Seite sehe?

Drei häufige Ursachen. Erstens JavaScript-Rendering: Wenn die Seite Links Client-Side injiziert, verpasst der HTML-nur-Abruf sie. Wechsle zum google-crawler-simulator für vollständiges Rendering. Zweitens, das Tool schließt Nicht-<a href> Elemente aus. Buttons, die wie Links gestylt sind, und JavaScript-Handler zählen nicht als crawlbare Links und werden nicht angezeigt. Suchmaschinen ignorieren sie auch, daher ist die Lücke aus SEO-Sicht korrekt. Drittens, Anker-Sprünge und mailto/tel-Links werden als ihre eigenen Typen kategorisiert. Wenn dein Filter auf Internal only eingestellt ist, werden mailto-Links nicht angezeigt. Wechsle zu All links, um das vollständige Inventar zu sehen. Etwa 95% der „fehlender Link"-Berichte gehen auf eine dieser drei Ursachen zurück.

Was ist ein gutes Verhältnis von internen zu externen Links?

Für SEO-fokussierte Content-Seiten zielen auf 80-90% interne Links und 10-20% externe Links. Seiten, die auf Seite eins für kommerzielle Keywords ranken, haben durchschnittlich 12-18% externe Links und 82-88% interne Links, laut Ahrefs-Analysen von 50.000 SERPs im Jahr 2024. Zu wenige externe Zitate (unter 5%) signalisieren dünne oder selbstbezügliche Inhalte. Zu viele (über 30%) lecken Autorität und sehen spammig aus. Die Mischung spielt eine Rolle. Externe Links sollten auf autoritative Quellen zeigen (Peer-Review-Studien, Regierungsdaten, Top-Tier-Publikationen). Interne Links sollten kontextuell verwandte Seiten verbinden, nicht nur Nav-Elemente. Führe diesen Extractor auf deine Top-10 organischen Landing-Pages aus und berechne das Verhältnis. Wenn du außerhalb des 80/20-Bands bist, schreibe zuerst die Link-Mischung auf den unterperformenden Seiten um.

Ist dieser Link-Extractor kostenlos?

Ja. Der Link-Extractor ist kostenlos ohne Anmeldung, keine nennenswerten Rate-Limits für normales Audit-Gebrauch und keine Nutzungs-Kappe. Füge eine URL ein, erhalte eine strukturierte Tabelle jeden Links, kopiere oder lade als CSV herunter. Das Tool ruft HTML serverseitig ab und führt die Parsing-Logik auf unserer Infrastruktur aus, daher brauchst du Browser-Erweiterungen nicht zu installieren oder Scraping-Skripte lokal auszuführen. Es funktioniert auf jeder öffentlich erreichbaren Seite. Seiten hinter Authentifizierung, Paywalls oder aggressivem Bot-Schutz geben einen Abruffehler zurück. Die meisten Seiten geben Ergebnisse in 2-4 Sekunden zurück, egal Link-Zählung. Die Ausgabe enthält Ankertext, rel-Attribute, target, interne vs. externe Klassifizierung und Link-Typ. Für Bulk-URL-Inventar-Arbeit, wo du eine Liste von URLs zum Dedupe hast, verwende stattdessen den url-extractor.

Wie überprüfe ich auf kaputte nofollow-Tags?

Füge die URL ein und wechsle den Show-Filter auf Nofollow only. Das Ergebnis zeigt jeden Link mit rel="nofollow", rel="sponsored" oder rel="ugc". Scanne die Liste nach zwei Fehler-Modi. Erstens, interne Navigation oder Footer-Links, die nofollow tragen: Diese sollten fast nie nofollowed sein, weil sie interne Link-Equity auf Seiten verschwenden, die du kontrollierst. Behebe durch Entfernen des rel-Attributs. Zweitens, Sponsored oder Affiliate-Links ohne das Sponsored oder ugc-Tag: Diese sollten den richtigen rel-Wert tragen, um konform mit Googles Link-Spam-Richtlinie zu sein. Etwa 20-30% der von uns gesampelten Websites haben mindestens einen missbrauchten nofollow. Das Erfassen sie früh verhindert versehentliche manuelle Maßnahmen. Führe dieses Audit auf jede Seite durch, die bezahlte Platzierungen, Affiliate-Links oder nutzergenerierte Kommentare trägt.

Was zeigt der Empty anchor text only-Filter?

Der Empty anchor text only-Filter zeigt jeden Link auf der Seite, wo der sichtbare Text fehlt oder nur Leerraum enthält. Die häufigsten Fälle sind Logo-Wrapper (ein <a> um ein <img> ohne alt-Text), nur-Icon-Buttons (Social-Share-Icons, Such-Icons) und dekorative Links, die Hintergrund-Bilder umhüllen. Leere Anker schaden SEO, weil Crawler Link-Kontext nicht ableiten können, und sie schlagen Accessibility-Audits fehl, weil Screen Reader nichts ankündigen. WCAG 2.2 Success Criterion 2.4.4 erfordert, dass jeder Link einen zugänglichen Namen hat. Die Lösung besteht darin, entweder alt-Text zum umhüllten Bild hinzuzufügen, aria-label zum Link hinzuzufügen oder den nur-Icon-Link durch eine beschriftete Komponente zu ersetzen. Eine saubere Seite sollte null empty-anchor-Zeilen haben. Eine 5%+ empty-anchor-Rate signalisiert, dass ein Accessibility-Audit überfällig ist.

Was ist der beste Link-Extractor für SEO-Audits?

Der beste Link-Extractor für SEO-Audits gibt DOM-bewusste Ausgabe zurück: Ankertext, rel-Attribute, target und interne vs. externe Klassifizierung pro Zeile. Regex-basierter Extractors verpassen diesen Kontext. Browser-Erweiterungen funktionieren für One-Off-Überprüfungen, skalieren aber nicht zu Multi-Page-Audits. Server-seitige HTML-Parser (wie dieses Tool) treffen den Sweet-Spot für schnelle Per-Page-Audits. Für vollständige Site-Crawls von 1.000+ Seiten machen dedizierte Crawler wie Screaming Frog oder Sitebulb Sinn. Für Per-Page-Audits während Content-Produktion oder Template-QA gibt dieses Tool Ergebnisse in 2-4 Sekunden mit null Setup zurück. Der Show-Filter lässt dich in einem Klick zu Internal, External, Nofollow oder Empty anchor zusammenbrechen, was spezifische Audits schneller macht als Spreadsheet-Manipulation. Verbinde ihn mit dem canonical-checker, wenn du auch Ziel-Kanonisierungs-Signale überprüfen musst.

Verwandte kostenlose Tools

Alle Tools →