Guia
Páginas órfãs: como encontrá-las e o que fazer com elas
Uma página órfã não tem links internos a apontar para ela. Ela existe, pode estar no seu sitemap e, para tudo o que siga links, é invisível. Quase todos os sites com mais de um ano têm-nas — e quase ninguém consegue nomear as suas.
O que conta como órfão e o que não conta
Uma página fica órfã quando nenhuma outra página do mesmo site tem links para ela. Esse é o único critério. Três coisas são confundidas com isto:
- Uma página com noindex não é órfã. Deste instruções aos motores de busca para o ignorarem de propósito. Isso é uma decisão, não um acidente.
- Um erro 404 não é um órfão. O órfão existe e carrega perfeitamente. É isso que o torna fácil de ignorar — nada está avariado.
- Estar no mapa do site não o salva. Um sitemap diz a um crawler que um URL existe. Os links internos dizem-lhe que o URL importa, e aproximadamente quanto. O sitemap por si só é um sinal fraco.
Uma melhoria útil: uma página acessível apenas a partir de um arquivo paginado — a página sete de uma lista de um blog — tecnicamente não está órfã, mas está suficientemente perto para ser tratada da mesma forma. Os profissionais às vezes chamam a isto quase-órfãos. Eles recebem um ligação, mas a partir de uma página que por si só se encontra profundamente enterrada e tem pouco peso.
Como as páginas acabam por ficar órfãs
Ninguém cria um órfão deliberadamente. Acabam por se acumular através da manutenção normal do site:
- O arquivo desloca-se. Uma publicação sai da primeira página do blog, depois da terceira, e eventualmente nada liga a ela, exceto uma listagem paginada que ninguém rastreia profundamente.
- Uma campanha termina. A página de destino continua ativa muito depois de o banner que dava acesso a ela ter sido retirado.
- A navegação é limpa. Um item de menu é removido para simplificar o cabeçalho, e todas as páginas que dependiam dele perdem a respetiva única ligação.
- O conteúdo foi migrado. As páginas são importadas, mas as ligações entre elas não.
- Uma categoria é reestruturada. Os produtos ou publicações movem-se, a página da categoria antiga é despublicada e as respetivas subcategorias ficam sem associação.
O fio condutor: a página foi ligada uma vez, e a ligação desapareceu através de uma alteração à qual ninguém a ligou.
O que lhe custa realmente
Três custos separados, e o terceiro é o que mais dói:
- Rastejamento. Os motores de busca alocam atenção finita por site. As páginas para as quais nada aponta são visitadas raramente, pelo que as alterações feitas nelas são detetadas tardiamente.
- Autoridade. Qualquer que seja a autoridade do vosso domínio, esta propaga-se através dos links internos. Uma página que não receba nenhum não herda nenhum, e compete isoladamente a partir da linha de partida.
- O trabalho já pago. Alguém investigou, escreveu e editou essa página. Ela continua a ser boa. Simplesmente não consegue ser encontrada pelo mecanismo em que a maioria das suas outras páginas se baseia. As páginas órfãs são habitualmente o tráfego mais barato num site precisamente porque a parte mais dispendiosa já está feita.
Encontrar o teu, passo a passo
O método é uma subtração: tudo o que existe, menos tudo o que um crawler consegue alcançar seguindo hiperligações. O que sobra está órfão.
- Obter a lista de tudo o que existe. O seu sitemap XML é a fonte mais fácil. Se suspeitar que o próprio sitemap está incompleto, exporte a lista de URLs do seu CMS — um sitemap que omite uma página também esconderá a órfã.
- Explorar o site a partir da página inicial. O Screaming Frog e o Sitebulb fazem ambos isto. O 'crawler' segue apenas os links, exatamente como faria um motor de busca, e produz a lista de tudo o que é acessível.
- Introduza o sitemap no mesmo rastreio. Ambas as ferramentas aceitam o sitemap como uma fonte adicional e sinalizam diretamente as diferenças para si — no Screaming Frog em Crawl Analysis, como URLs órfãs.
- Cruzar com o tráfego real. Exporte páginas com impressões do Search Console e do seu analítico. Uma página para a qual nenhum link aponta, mas que ainda assim recebe visitas, é o tipo mais valioso de órfã — está a posicionar-se apesar da desvantagem.
- Filtre o que pertence lá. Páginas de agradecimento, etapas de checkout, páginas de destino de campanhas que mantém deliberadamente sem links. Estar sem links só é um problema quando não foi uma decisão.
O Search Console por si só não lhe dará uma resposta clara. O respetivo relatório de Links mostra os destinos com mais links, não os que não têm links — a ausência de uma lista principal não é prova de ausência. Utilize-o como a verificação cruzada de tráfego no passo quatro, e não como a fonte da verdade no passo três.
Ligar, fundir ou remover
Não ligue tudo de volta de forma reflexiva. Cada órfão recebe um de três veredictos, e a pergunta que o decide é simples: Publicaria esta página hoje?
- Faz a ligação — se a resposta for afirmativa. Encontre duas ou três páginas cujo tema conduza genuinamente até lá e coloque a ligação a partir do texto, e não de uma lista de rodapé. Uma ligação editorial vale mais do que cinco decorativas.
- Fundir — se a resposta for “não por si só, mas o conteúdo vale a pena ser mantido”. Integre-o numa página mais forte sobre o mesmo tema e redirecione o URL antigo para lá. Esta é habitualmente a decisão certa para publicações superficiais que se sobrepõem.
- Remover — se a resposta for não. Apague-a e deixe-a devolver um 410, ou redirecione-a se tiver quaisquer links de entrada ou tráfego residual. Deixar páginas fracas ativas para “não perder nada” é a forma como os sites acumulam o lastro que arrasta o resto para baixo.
Trabalhe com eles por tráfego, do maior para o menor. Uma página órfã com impressões é uma página que já está a posicionar-se com uma mão atada; criar um link para ela é a vitória mais rápida disponível na maioria dos sites.
Evitar que volte a acontecer
Encontrar órfãos é uma limpeza. Não os produzir é um hábito, e resume-se a três coisas:
- Ligação na publicação, não mais tarde. Quando uma página for publicada, decida ali mesmo quais duas ou três páginas existentes devem apontar para ela — e edite-as. “Vou adicionar links mais tarde” é a forma como o *backlog* começa.
- Tratar as alterações estruturais como alterações de links. Remover um item de menu, retirar uma categoria, despublicar um hub: cada uma destas ações corta ligações. Pergunte o que perde a sua rota antes de fazer a alteração, e não depois.
- Reexplorar segundo um calendário. Trimestralmente é suficiente para a maioria dos sites. Demora vinte minutos e apanha o desvio antes de se tornar num projeto.
O ponto estrutural merece ser ponderado. Os órfãos raramente são um problema de conteúdos — são um efeito secundário da arrumação. Cada simplificação de uma navegação esconde alguma coisa.
Onde este plugin se enquadra. Internal Links Manager não encontra páginas órfãs — isso é trabalho de um crawler, e o Screaming Frog ou o Sitebulb fazem-no bem. O que faz é impedir que apareçam novas: assim que uma regra aponta uma palavra-chave para uma página, todas as publicações futuras que mencionem esse termo criam um link para lá automaticamente, incluindo publicações escritas muito mais tarde. A limpeza continua a ser manual; o desvio não volta. Veja como as regras funcionam.
A versão curta. Um órfão é uma página para a qual nenhuma outra remete — não está quebrada, está apenas invisível. Encontre-as fazendo um rastreio a partir da página inicial e subtraindo isso ao seu sitemap. Ordene por tráfego e depois decida por página: crie um link para ela, funda-a ou remova-a. E coloque links nas páginas novas no dia em que forem publicadas, porque esse é o único momento em que alguém se lembra de o fazer de forma fiável. Relacionado: o guia completo de links internos e escolher o texto âncora.