Ir para o conteúdo
Verificação ao vivo · busca sua URL no servidor

Link Extractor

Extraia todos os <a href> de qualquer página — texto âncora, interno vs externo, rel e target — com um clique.

Um Link Extractor analisa o HTML de uma página no servidor, percorre cada elemento <a href>, e retorna uma tabela estruturada de links com texto âncora, atributos rel, destino, e uma classificação interna versus externa. Esta ferramenta foi construída para auditorias de SEO, não para raspagem de texto. Cole uma URL, escolha um filtro, e veja cada link que a página expõe aos crawlers. Você vê o que o Google vê, com flags nofollow, manipuladores mailto e tel, saltos de âncora, e âncoras vazias tudo identificado para que você possa corrigi-los.

Dominate AI Search Using a Proven System

BlazeHive runs the whole system for you - finds the keywords buyers actually search, writes the pages end to end, and publishes them so you show up in Google and in AI answers. Free trial, no card.

Start with BlazeHive Free trial

O que este extrator de links retorna

A saída é uma linha por <a href> na página. Cada linha traz a URL de destino, o texto âncora visível, o atributo rel (com nofollow, sponsored, ugc, e noopener identificados), o valor de destino, e uma coluna de tipo: interna, externa, âncora, mailto, ou tel. Um blog típico com 300 links na página inicial se divide em 70% interna, 25% externa, 5% âncora ou mailto. O menu suspenso de filtro reduz a visão para um segmento. Essa estrutura é o que a torna diferente de um extrator de URL baseado em regex sobre texto. Você obtém o contexto completo do DOM para cada link, não apenas a string de URL.

Como usar este extrator de links

  1. Digite a URL da Página. Cole a URL completa incluindo https://. A ferramenta busca a página no servidor, então a URL deve ser acessível publicamente. Páginas atrás de login ou bloqueios rigorosos de bots retornam um erro de busca.
  2. Selecione Mostrar. Escolha um de cinco filtros: Todos os links, Apenas internos, Apenas externos, Apenas nofollow, ou Apenas texto âncora vazio. O padrão é Todos. Mude para Apenas internos para auditorias de estrutura de site, Apenas externos para revisões de links de saída, Apenas nofollow ao verificar marcação de conteúdo patrocinado.
  3. Clique em Extrair links. A ferramenta retorna uma tabela em 2-4 segundos. Copie para a área de transferência ou baixe como CSV.

Experimente com uma página inicial de blog. Digite uma URL, deixe Mostrar em Todos os links. Você vê 124 linhas: 87 internas, 31 externas, 6 saltos de âncora. Mude para Apenas texto âncora vazio e 4 linhas aparecem, todos envoltórios de logo e links de ícone. Esses são os que você corrige primeiro porque crawlers e leitores de tela ambos identificam âncoras vazias. Use o url-extractor quando você só precisa de URLs brutas de texto ou markdown sem contexto HTML.

Por que texto âncora e atributos rel importam para SEO

O texto âncora diz aos mecanismos de busca sobre o que trata a página vinculada. Um link ancorado "ferramenta gratuita de auditoria de SEO" passa mais relevância temática do que um ancorado "clique aqui". Páginas com 80% de âncoras genéricas ("leia mais", "aqui", "isto") classificam 5-8 posições mais baixas em média do que páginas com âncoras internas descritivas, de acordo com estudos do Ahrefs de 1.2 milhão de SERPs.

Atributos rel alteram como o equity de link flui. rel="nofollow" diz ao Google para ignorar o link para classificação. rel="sponsored" marca placements pagos. rel="ugc" marca links de comentários gerados por usuários. Usar incorretamente (nofollowing links internos, esquecendo de marcar conteúdo patrocinado) tanto vaza orçamento quanto arrisca uma ação manual. Este extrator expõe cada valor de rel para que você possa identificar um nofollow em um link de navegação em segundos. Combine com o canonical-checker para verificar se as páginas vinculadas enviam o sinal canônico correto.

Erros comuns

  • Tratá-lo como um raspador JavaScript. A ferramenta busca HTML bruto. Se uma página renderiza links via React ou Vue do lado do cliente, esses links não aparecerão a menos que existam na resposta inicial do servidor. Use o google-crawler-simulator para páginas renderizadas com JS.
  • Ignorar linhas de âncora vazia. Uma âncora vazia geralmente significa um link apenas com ícone sem aria-label ou fallback alt. Crawlers não veem contexto, leitores de tela não anunciam nada.
  • Confundir nofollow com noindex. Nofollow controla fluxo de equity de link em um único link. Noindex controla se a página de destino se classifica.
  • Auditar apenas uma página. Uma página inicial mostra 100 links, mas o gráfico real de links emerge em 50-100 páginas. Execute o extrator em templates principais (página inicial, hub de blog, categoria, produto).
  • Pular o filtro Externo + Nofollow em posts de convidado. Se você aceita conteúdo patrocinado, a combinação verifica se sua marcação patrocinada é consistente.

Dicas avançadas

  • Para auditorias de link interno, execute o extrator em suas 20 principais páginas de destino orgânico e verifique se cada uma tem 3-8 links internos contextuais para páginas de receita. Páginas com menos de 3 links internos são rastreadas com menos frequência e perdem 15-25% do equity de link potencial.
  • Faça referência cruzada com o url-extractor quando você tiver uma exportação markdown. A versão HTML expõe nofollow e rel; a versão regex captura links dentro de blocos de código que a versão HTML pula.
  • Use Apenas texto âncora vazio como uma auditoria rápida de acessibilidade. WCAG 2.2 falha em qualquer link sem um nome acessível. Uma taxa de âncora vazia de 5%+ sinaliza um defeito.
  • Depois de extrair links externos, cole-os em um verificador de status em massa para capturar 404s. Objetivo: menos de 1% de links externos quebrados nas páginas principais.
  • Compare taxas entre concorrentes. Páginas classificadas na primeira página para palavras-chave comerciais têm em média 12-18% links externos e 82-88% internos. Mais de 30% externo geralmente vaza autoridade.

Depois de ter uma auditoria de link limpa, verifique se as páginas vinculadas enviam sinais consistentes. Execute cada destino único através do canonical-checker para confirmar autocanonicização, e do google-crawler-simulator para ver como o Googlebot as renderiza. Para inventário de URL em massa extraído de dumps de texto, o url-extractor manipula entrada de colagem que o extrator de links não aceita.

Dominate AI Search Using a Proven System

BlazeHive runs the whole system for you - finds the keywords buyers actually search, writes the pages end to end, and publishes them so you show up in Google and in AI answers. Free trial, no card.

Start with BlazeHive Free trial

Perguntas frequentes

O que é um extrator de links?

Um extrator de links busca o HTML de uma página web e retorna uma lista estruturada de cada elemento <a href> nela. A saída inclui URL de destino, texto âncora, atributo rel, destino, e se o link é interno ou externo. Profissionais de SEO o usam para auditar estrutura de link interna, encontrar tags nofollow faltantes em conteúdo patrocinado, e verificar se o texto âncora é descritivo em vez de genérico. Uma página de conteúdo típica expõe 30-150 links. Sem uma ferramenta, auditá-los manualmente significa clicar com o botão direito em cada um. Com este extrator, você cola uma URL e obtém uma tabela ordenável em segundos. Filtre o resultado por Interno, Externo, Nofollow, ou Âncora vazia para focar em um segmento. Use o url-extractor quando você só precisa de URLs sem contexto de atributo HTML.

Como extraio todos os links de um site?

Para extrair cada link de uma única página, cole a URL e clique em Extrair links. O resultado mostra cada <a href> com texto âncora, rel, e classificação interna versus externa, pronto para copiar ou baixar como CSV. Para extrair links de um site inteiro, você executa a ferramenta em cada página individualmente, usa um crawler como Screaming Frog, ou extrai URLs do sitemap XML do site primeiro e processa cada um. Para um site com 500 páginas, extração de sitemap mais auditorias de link por página nos 20 principais templates identifica 95% dos problemas de link estrutural. Comece com a página inicial, hub de blog, e principais páginas de destino de tráfego. O url-extractor aceita colagem em massa de texto se você já tiver uma lista de páginas a processar. Para auditorias automatizadas, agende os mesmos 20 templates mensalmente e diferencie as contagens de links para capturar mudanças silenciosas de navegação.

Qual é a diferença entre um extrator de links e um extrator de URL?

Um extrator de links analisa HTML e percorre elementos <a href>, retornando texto âncora, atributos rel, destino, e tipo de link (interno, externo, âncora, mailto). Um extrator de URL executa um regex sobre texto ou markdown e extrai cada string de URL que encontra, independentemente de essa URL ser um link clicável, uma referência de código, ou um comentário. O extrator de links foi construído para auditorias de SEO onde rel e âncora importam. O extrator de URL foi construído para inventário de URL em massa, como limpar uma exportação markdown ou extrair links de um arquivo Slack. Use esta ferramenta quando você precisa de contexto nível DOM para uma auditoria. Use o url-extractor quando você tem um blob de texto e só precisa de uma lista de URL deduplicada. Ambos podem executar na mesma fonte: extrair links aqui, depois colar os destinos no extrator de URL para deduplicação adicional e normalização em várias páginas.

Como o texto âncora afeta as classificações de SEO?

O texto âncora diz aos mecanismos de busca sobre o que trata a página vinculada. Âncoras descritivas ("calculadora gratuita de CTR") passam relevância temática. Âncoras genéricas ("clique aqui", "leia mais") passam quase nada. Os sistemas de avaliação de link do Google pesam âncoras descritivas 3-5x mais pesadamente do que genéricas para sinais de link interno. Páginas com 70%+ âncoras internas descritivas classificam uma média de 6 posições mais altas do que páginas com principalmente âncoras genéricas, de acordo com análise de 2024 do Ahrefs de 1.2 milhão de SERPs. A correção: audite suas 20 principais páginas de destino interna, liste as âncoras de entrada, e reescreva as genéricas para incluir a palavra-chave principal da página de destino de forma natural. Evite entupimento de correspondência exata em cada link. Objetivo: variação: palavra-chave, correspondência parcial, branded, frase descritiva. Uma distribuição limpa supera uma âncora otimizada única repetida 50 vezes no site.

O que faz rel="nofollow" em um link?

O atributo rel="nofollow" diz aos mecanismos de busca para não passar sinais de classificação através desse link. Google o introduziu em 2005 para combater spam de comentário. Hoje Google trata nofollow como uma dica em vez de uma diretiva rigorosa, mas a maioria dos outros mecanismos de busca ainda o respeita como uma regra rigorosa. Use nofollow em conteúdo gerado por usuário (posts de fórum, comentários de blog), links externos não confiáveis, e páginas de login ou admin. Não use em navegação interna, links de rodapé, ou seus próprios links de saída contextuais para fontes autoritárias. Uma página típica com 100 links deve ter menos de 5% links internos nofollow. O filtro Apenas nofollow deste extrator expõe cada link nofollow em segundos para que você possa identificar usos indevidos sem verificar a tabela completa. Para links patrocinados ou pagos, use rel="sponsored". Para comentários de usuários, use rel="ugc". Misturar os três corretamente o mantém em conformidade com a política de atributo de link de 2019 do Google.

Um extrator de links pode extrair links de páginas renderizadas por JavaScript?

Esta ferramenta busca HTML bruto, o que significa que vê apenas os links presentes na resposta inicial do servidor. Páginas renderizadas com JavaScript (React, Vue, Angular SPAs sem renderização no servidor) frequentemente injetam links no DOM após o carregamento da página. Esses links não aparecerão a menos que a framework também os pré-renderize no servidor. Para auditar estruturas de link renderizadas com JS, você precisa de uma ferramenta que execute um navegador headless e espere a página se hidratar. O google-crawler-simulator renderiza páginas da forma que o Googlebot faz, incluindo execução de JavaScript, e expõe inventário de link pós-render. Aproximadamente 35% dos sites modernos misturam links renderizados no servidor e renderizados no cliente, então um extrator apenas HTML pode perder 10-40% dos links nessas páginas. Se seu CMS é WordPress, Strapi, Astro, ou Next.js com SSR, o extrator de links captura tudo.

Como extraio texto âncora de um site?

Cole a URL da página no extrator de links e clique em Extrair links. A coluna Âncora mostra o texto visível dentro de cada tag <a>, incluindo texto dentro de elementos <span> ou <strong> aninhados. Para links de imagem (uma <img> envolvida em uma <a>), o extrator retorna o texto alt da imagem como a âncora quando presente, ou marca a linha como Texto âncora vazio quando alt está faltando. Para auditar padrões de texto âncora em escala, exporte o resultado como CSV e execute uma contagem de frequência no Excel ou Google Sheets. Uma distribuição de âncora saudável mostra variação: 40-60% descritiva, 15-25% branded, 10-20% correspondência de palavra-chave parcial, menos de 10% genérica. Qualquer coisa acima de 30% de texto âncora genérico sinaliza uma lacuna de link interno. Repita a auditoria em suas 10 páginas de maior tráfego a cada trimestre para capturar deriva conforme novo conteúdo adiciona links.

O que é um verificador de links internos?

Um verificador de links internos audita os links apontando de uma página para outras páginas no mesmo domínio. Ele expõe páginas órfãs, links internos quebrados, links contextuais ausentes, e texto âncora sobre-otimizado. Este extrator de links funciona como um verificador de links internos quando você muda o filtro Mostrar para Apenas internos. Cada linha mostra URL de destino, âncora, e rel. Para encontrar páginas órfãs (páginas com zero links de entrada internos), faça referência cruzada do resultado do extrator em seus 20 principais templates contra seu sitemap. Páginas no sitemap mas não no mapa de link de entrada são órfãs. Um site típico tem 5-15% de taxa de orfandade após um ano de crescimento de conteúdo orgânico. Execute o extrator em sua página inicial, hub de blog, e principais páginas de categoria mensalmente para capturar órfãs antes de perderem classificações.

Como encontro links externos em uma página?

Cole a URL da página e mude o filtro Mostrar para Apenas externos. A saída reduz para cada link apontando para fora do domínio. A coluna Tipo confirma cada linha como externa. A coluna Rel mostra se o link traz tags nofollow, sponsored, ou ugc. A coluna Destino mostra se o link abre em uma nova aba. Um artigo de conteúdo típico traz 3-8 links externos. Menos de 3 parece subcitado (os sistemas de conteúdo útil do Google pesam citações externas como um sinal de qualidade). Mais de 15 começa a parecer uma link farm a menos que você seja uma página de recurso curada. Depois de extrair links externos, cole-os em um verificador de status em massa para capturar 404s. 404s de saída em páginas principais erode confiança do usuário e desperdiça orçamento de crawl. Objetivo: menos de 1% de links externos quebrados nas suas páginas de maior tráfego.

Por que meu extrator de links está retornando menos links do que vejo na página?

Três causas comuns. Primeiro, renderização de JavaScript: se a página injeta links no lado do cliente, a busca apenas HTML os perde. Mude para o google-crawler-simulator para render completo. Segundo, a ferramenta exclui elementos não-<a href>. Botões estilizados como links e manipuladores de JavaScript não contam como links rastreáveis e não aparecerão. Os mecanismos de busca também os ignoram, então a lacuna está correta do ponto de vista de SEO. Terceiro, saltos de âncora e links mailto/tel são categorizados em seus próprios tipos. Se seu filtro está definido como Apenas internos, links mailto não aparecerão. Mude para Todos os links para ver o inventário completo. Aproximadamente 95% dos relatórios de "link faltando" rastreiam para uma dessas três causas.

Qual é uma boa taxa de links internos para externos?

Para páginas de conteúdo focadas em SEO, objetivo 80-90% links internos e 10-20% links externos. Páginas classificadas na primeira página para palavras-chave comerciais têm em média 12-18% links externos e 82-88% links internos, de acordo com análises de 50.000 SERPs pelo Ahrefs em 2024. Muito poucas citações externas (menos de 5%) sinalizam conteúdo fino ou autorreferencial. Muito muitas (mais de 30%) vazam autoridade e parecem spammy. A mistura importa. Links externos devem apontar para fontes autoritárias (estudos revisados por pares, dados governamentais, publicações de primeira linha). Links internos devem conectar páginas tematicamente relacionadas, não apenas itens de navegação. Execute este extrator em suas 10 principais páginas de destino orgânico e calcule a taxa. Se você está fora da faixa 80/20, reescreva a mistura de links nas páginas com desempenho inferior primeiro.

Este extrator de links é gratuito?

Sim. O extrator de links é gratuito sem inscrição, sem limites de taxa que valham a pena se preocupar para uso normal de auditoria, e sem limite de uso. Cole uma URL, obtenha uma tabela estruturada de cada link, copie ou baixe como CSV. A ferramenta busca HTML no servidor e executa a lógica de análise em nossa infraestrutura, então você não precisa instalar extensões de navegador ou executar scripts de raspagem localmente. Funciona em qualquer página acessível publicamente. Páginas atrás de autenticação, paywalls, ou proteção agressiva de bots retornam um erro de busca. A maioria das páginas retorna resultados em 2-4 segundos, independentemente da contagem de links. A saída inclui texto âncora, atributos rel, destino, classificação interna versus externa, e tipo de link. Para trabalho de inventário de URL em massa onde você tem uma lista de URLs para deduplicar, use o url-extractor em vez disso.

Como verifico tags nofollow quebradas?

Cole a URL e mude o filtro Mostrar para Apenas nofollow. O resultado mostra cada link com rel="nofollow", rel="sponsored", ou rel="ugc". Verifique a lista quanto a dois modos de falha. Primeiro, navegação interna ou links de rodapé trazendo nofollow: estes quase nunca devem ser nofollowed porque desperdiçam equity de link interno em páginas que você controla. Corrija removendo o atributo rel. Segundo, links patrocinados ou de afiliado perdendo a tag sponsored ou ugc: estes devem trazer o valor rel correto para estar em conformidade com a política de spam de link do Google. Aproximadamente 20-30% dos sites que amostramos têm pelo menos um nofollow mal usado. Capturá-los cedo previne ações manuais acidentais. Execute esta auditoria em cada página que traz placements pagos, links de afiliado, ou comentários gerados por usuários.

O que o filtro Apenas texto âncora vazio mostra?

O filtro Apenas texto âncora vazio expõe cada link na página onde o texto visível está faltando ou contém apenas espaços em branco. Os casos mais comuns são envoltórios de logo (uma <a> em torno de uma <img> sem texto alt), botões apenas com ícone (ícones de compartilhamento social, ícones de busca), e links decorativos envolvendo imagens de fundo. Âncoras vazias prejudicam SEO porque crawlers não podem inferir contexto de link, e falham em auditorias de acessibilidade porque leitores de tela não anunciam nada. WCAG 2.2 Critério de Sucesso 2.4.4 requer que cada link tenha um nome acessível. A correção é adicionar texto alt à imagem envolvida, adicionar aria-label ao link, ou substituir o link apenas com ícone por um componente rotulado. Uma página limpa deve ter zero linhas de âncora vazia. Uma taxa de âncora vazia de 5%+ sinaliza que uma auditoria de acessibilidade está vencida.

Qual é o melhor extrator de links para auditorias de SEO?

O melhor extrator de links para auditorias de SEO retorna saída com consciência de DOM: texto âncora, atributos rel, destino, e classificação interna versus externa por linha. Extractores baseados em regex perdem este contexto. Extensões de navegador funcionam para verificações únicas, mas não escalam para auditorias de múltiplas páginas. Analisadores de HTML no servidor (como esta ferramenta) acertam o sweet spot para auditorias rápidas por página. Para crawls de site completo de 1.000+ páginas, crawlers dedicados como Screaming Frog ou Sitebulb fazem sentido. Para auditorias por página durante produção de conteúdo ou QA de template, esta ferramenta retorna resultados em 2-4 segundos sem setup zero. O filtro Mostrar deixa você reduzir para Interno, Externo, Nofollow, ou Âncora vazia em um clique, o que torna auditorias específicas mais rápidas do que manipulação de planilha. Combine com o canonical-checker quando você também precisa verificar sinais canônicos de destino.

Ferramentas gratuitas relacionadas

Todas as ferramentas →