Conteúdo duplicado: o que é e quando é mesmo um problema
O Google não castiga quem tem textos repetidos, mas escolhe uma versão e ignora as outras, e nem sempre escolhe a que queria. As causas mais comuns e como resolvê-las.
Há um mito persistente de que ter conteúdo duplicado dá uma penalização no Google. Não é bem assim. Salvo em casos de cópia deliberada para manipular resultados, não há castigo. O que acontece é outra coisa: quando encontra várias páginas iguais ou muito parecidas, o Google agrupa-as, escolhe uma para mostrar e ignora as restantes. O problema é que nem sempre escolhe a que queria, e os sinais ficam divididos.
As causas mais comuns
A maioria do conteúdo duplicado é técnico e involuntário:
- O mesmo site acessível em várias versões: com e sem www, http e https, com e sem barra no fim do endereço.
- Parâmetros nos endereços: códigos de campanha (utm), filtros, ordenações e identificadores de sessão criam endereços diferentes para a mesma página.
- Descrições de produto copiadas do fabricante, iguais em dezenas de lojas.
- Páginas de serviço ou de localidade feitas a partir do mesmo modelo, com poucas palavras diferentes.
- Versões para impressão, páginas de etiquetas e arquivos de blog que repetem os mesmos excertos.
- Textos copiados por outros sites.
Como resolver
- Escolha uma versão do domínio (por exemplo, https e sem www) e redirecione todas as outras para ela com redirecionamentos 301.
- Use a etiqueta canónica: em cada página, indique qual é o endereço principal. As variantes com parâmetros apontam para a versão limpa.
- Ligue sempre para a versão canónica nos links internos, no menu e no sitemap.
- Reescreva descrições de produto e páginas de serviço para que cada uma tenha conteúdo próprio.
- Exclua da indexação páginas sem valor próprio, como resultados de pesquisa interna e ordenações.
E quando copiam o seu conteúdo?
Na maioria dos casos, o Google identifica a fonte original, sobretudo se o seu site é mais antigo e tem mais autoridade. Se um site copia os seus textos e aparece à sua frente nos resultados, pode pedir a remoção ao abrigo dos direitos de autor através do formulário próprio do Google. Para o resto, um site com links internos sólidos e conteúdo atualizado raramente perde para cópias.
Como detetar
- No Google Search Console, os estados "Duplicada sem página canónica selecionada pelo utilizador" e "Duplicada, o Google escolheu uma página canónica diferente da do utilizador" indicam páginas que o Google considera repetidas.
- Copie uma frase característica de uma página, coloque-a entre aspas e pesquise no Google: vê onde mais existe aquele texto.
- Uma ferramenta de rastreio mostra títulos e descrições repetidos, que muitas vezes denunciam páginas quase iguais.
O duplicado que mais custa
O conteúdo duplicado técnico resolve-se de uma vez. O que mais custa a longo prazo é o duplicado editorial: páginas de serviço genéricas, iguais às da concorrência, que podiam pertencer a qualquer empresa. O Google não as castiga, mas também não tem razão nenhuma para as preferir. Conteúdo específico, com os seus exemplos, preços, prazos e casos, é a forma mais segura de nunca ter este problema.
