Was dieser Link-Extractor zurückgibt
Die Ausgabe ist eine Zeile pro <a href> auf der Seite. Jede Zeile enthält die Ziel-URL, den sichtbaren Ankertext, das rel-Attribut (mit nofollow, sponsored, ugc und noopener gekennzeichnet), den target-Wert und eine Typ-Spalte: internal, external, anchor, mailto oder tel. Eine typische 300-Link-Blog-Startseite verteilt sich auf 70% intern, 25% extern, 5% Anker oder mailto. Das Dropdown-Filterfeld reduziert die Ansicht auf einen Bereich. Diese Struktur ist es, was sie von einem Regex-über-Text-URL-Puller unterscheidet. Du erhältst den vollständigen DOM-Kontext für jeden Link, nicht nur die URL-Zeichenkette.
Wie du diesen Link-Extractor verwendest
- Seiten-URL eingeben. Füge die vollständige URL einschließlich
https://ein. Das Tool ruft die Seite serverseitig ab, daher muss die URL öffentlich erreichbar sein. Seiten hinter Login oder strengen Bot-Blöcken geben einen Abruffehler zurück. - „Show" auswählen. Wähle einen von fünf Filtern: All links, Internal only, External only, Nofollow only oder Empty anchor text only. Standard ist All. Wechsle zu Internal only für Seitenstruktur-Audits, External only für Outbound-Überprüfungen, Nofollow only beim Überprüfen von Sponsored-Tagging.
- „Extract links" klicken. Das Tool gibt eine Tabelle innerhalb von 2-4 Sekunden zurück. In die Zwischenablage kopieren oder als CSV herunterladen.
Versuche das mit einer Blog-Startseite. Gib eine URL ein, lass Show auf All links. Du siehst 124 Zeilen: 87 intern, 31 extern, 6 Anker-Sprünge. Wechsle zu Empty anchor text only und 4 Zeilen tauchen auf, alles Logo-Wrapper und Icon-Links. Das sind die, die du zuerst behebst, denn Crawler und Screen Reader kennzeichnen beide leere Anker. Verwende den url-extractor, wenn du nur rohe URLs aus Text oder Markdown ohne HTML-Kontext brauchst.
Warum Ankertext und rel-Attribute für SEO wichtig sind
Ankertext sagt Suchmaschinen, worum es auf der verlinkten Seite geht. Ein Link mit Ankertext „kostenloses SEO-Audit-Tool" vermittelt mehr thematische Relevanz als einer mit Ankertext „hier klicken". Seiten mit 80% generischem Ankertext („mehr lesen", „hier", „das") rangieren durchschnittlich 5-8 Positionen niedriger als Seiten mit aussagekräftigen internen Ankern, laut Ahrefs-Studien von 1,2 Millionen SERPs.
rel-Attribute ändern, wie Link-Equity fließt. rel="nofollow" sagt Google, den Link für das Ranking zu ignorieren. rel="sponsored" kennzeichnet bezahlte Platzierungen. rel="ugc" kennzeichnet nutzergenerierte Comment-Links. Missbrauch (internen Links nofollow hinzufügen, vergessen, Sponsored-Content zu markieren) leckt entweder Budget oder riskiert eine manuelle Maßnahme. Dieser Extractor zeigt jeden rel-Wert an, damit du einen nofollow auf einen Navigations-Link in Sekunden entdeckst. Verbinde ihn mit dem canonical-checker, um zu überprüfen, dass die verlinkten Seiten das richtige kanonische Signal senden.
Häufige Fehler
- Es als JavaScript-Scraper behandeln. Das Tool ruft rohes HTML ab. Wenn eine Seite Links über Client-Side React oder Vue rendert, erscheinen diese Links nicht, wenn sie nicht in der initialen Server-Response vorhanden sind. Verwende den google-crawler-simulator für JS-gerenderter Seiten.
- Leere Anker-Zeilen ignorieren. Ein leerer Anker bedeutet normalerweise einen nur-Icon-Link ohne aria-label oder alt-Fallback. Crawler sehen keinen Kontext, Screen Reader geben nichts aus.
- nofollow mit noindex verwechseln. Nofollow steuert Link-Equity-Fluss bei einem einzelnen Link. Noindex steuert, ob die Zielseite selbst rankt.
- Nur eine Seite auditieren. Eine Startseite zeigt 100 Links, aber der echte Link-Graph entsteht über 50-100 Seiten. Führe den Extractor auf Top-Templates aus (Startseite, Blog-Hub, Kategorie, Produkt).
- Den External + Nofollow-Filter bei Gast-Beiträgen überspringen. Wenn du Sponsored-Content akzeptierst, bestätigt die Kombination, dass dein Sponsored-Tagging konsistent ist.
Fortgeschrittene Tipps
- Führe für interne Link-Audits den Extractor auf deinen Top-20 organischen Landingpages aus und überprüfe, ob jede 3-8 kontextuelle interne Links zu Revenue-Pages hat. Seiten mit unter 3 internen Links werden weniger oft gecrawlt und verlieren 15-25% der potenziellen Link-Equity.
- Cross-referenziere die Ausgabe mit dem url-extractor, wenn du einen Markdown-Export hast. Die HTML-Version zeigt nofollow und rel an; die Regex-Version erfasst Links in Code-Blöcken, die die HTML-Version überspringt.
- Verwende Empty anchor text only als schnelles Accessibility-Audit. WCAG 2.2 schlägt jeden Link ohne einen erreichbaren Namen fehl. Eine 5%+ Empty-Anchor-Rate signalisiert einen Defekt.
- Nachdem du externe Links extrahiert hast, füge sie in einen Bulk-Status-Checker ein, um 404er zu erfassen. Ziele auf unter 1% kaputte externe Links über Top-Pages.
- Vergleiche Verhältnisse mit Konkurrenten. Seiten, die auf Seite eins für kommerzielle Keywords ranken, haben durchschnittlich 12-18% externe Links und 82-88% interne. Über 30% extern leckt normalerweise Autorität.
Sobald du ein sauberes Link-Audit hast, überprüfe, dass die verlinkten Seiten konsistente Signale senden. Führe jedes eindeutige Ziel durch den canonical-checker, um Selbst-Kanonisierung zu bestätigen, und den google-crawler-simulator, um zu sehen, wie Googlebot sie rendert. Für Bulk-URL-Inventar aus Text-Dumps handhabt der url-extractor Paste-Eingaben, die der Link-Extractor nicht akzeptiert.