Como evitar página duplicada num e-commerce
Filtro de cor, filtro de tamanho e filtro de preço, além de ordenação por relevância ou menor preço, geram uma URL nova a cada combinação possível. Numa loja com poucos filtros, isso já cria centenas de endereços quase idênticos, e o Google trata isso como conteúdo duplicado, mesmo que ninguém tenha feito nada de errado de propósito.
- A causa mais comum de conteúdo duplicado num e-commerce é filtro e ordenação de página de categoria, segundo a própria documentação do Google.
- A correção certa é a tag canonical apontando para a versão sem filtro, não bloqueio por robots.txt.
- Página de produto sem estoque deve levar noindex se for provisório, ou responder 404 se o produto saiu de linha.
- Cada página de paginação precisa de URL própria e indexável, nunca a mesma URL para todas as páginas.
- Parâmetro de URL funciona melhor no formato chave-valor, como ?cor=verde, e nunca duplicado, como ?tipo=doce&tipo=azedo.
O erro mais caro em SEO para e-commerce não é falta de conteúdo, é deixar o próprio site competir contra si mesmo em centenas de URLs de filtro que ninguém pediu para existir separadamente, diluindo o sinal que poderia estar concentrado numa única página forte.
Este texto mostra como identificar e corrigir isso, com base na documentação oficial do Google para e-commerce, sem depender de conselho genérico de blog desatualizado.
O que gera conteúdo duplicado num e-commerce
A documentação da Central da Pesquisa do Google nomeia diretamente a causa mais comum: resultado de função de ordenação e filtro numa página de categoria. Isso confirma o que auditoria depois de auditoria costuma mostrar: o problema técnico mais frequente em e-commerce não é exclusivo de loja grande, aparece do mesmo jeito em catálogo pequeno com poucos filtros ativos.
Uma categoria com filtro de cor, tamanho, marca e faixa de preço pode gerar milhares de combinações de URL, cada uma mostrando praticamente o mesmo conteúdo da categoria original, só reordenado ou filtrado. O Google enxerga isso como duplicação, mesmo que cada URL individualmente pareça uma página legítima.
| Situação | O que fazer |
|---|---|
| Página de categoria com filtro aplicado | Canonical apontando para a categoria sem filtro |
| Página de categoria ordenada por preço ou relevância | Canonical apontando para a ordenação padrão |
| Página 2, 3 e seguintes de uma categoria | URL própria, sem canonical para a página 1 |
| Versão do produto com parâmetro de rastreamento | Canonical apontando para a URL sem o parâmetro |
| Categoria sem nenhum produto no momento | Tag noindex enquanto estiver vazia |
| Produto removido em definitivo | Código de resposta 404 |
A tabela cobre as seis situações mais comuns numa auditoria de e-commerce, e o padrão se repete: quase sempre a solução é apontar para a versão principal, nunca esconder a URL do Google.
Se você quer entender o quadro técnico completo antes de mexer em filtro, o checklist de SEO técnico cobre a base geral, e a estratégia completa de vendas online está detalhada na nossa página de SEO para e-commerce.
Como corrigir com canonical, sem usar robots.txt
A tag canonical, apontando da versão filtrada para a versão original da categoria, é o método que a própria documentação do Google recomenda como sinal forte de qual URL deveria ser a preferida, consolidando o valor de todas as variações numa única página.
A mesma documentação é explícita sobre o que não fazer: não use o arquivo robots.txt para canonicalização. O Google pode continuar indexando uma URL bloqueada em robots.txt sem o conteúdo dela, o que produz resultado pior do que não bloquear nada.
O critério prático: toda URL de filtro aponta, via canonical, para a categoria sem filtro. Todo link interno do site, incluindo menu e breadcrumb, aponta consistentemente para a versão canônica, nunca para a variação filtrada.
Misturar métodos diferentes de canonicalização na mesma página é o erro que a documentação chama de sinal conflitante. Isso acontece, por exemplo, quando o sitemap lista uma URL diferente da que a tag canonical indica, deixando o Google sem saber qual das duas seguir.
Estrutura de URL recomendada para parâmetro
A documentação oficial de e-commerce do Google recomenda parâmetro no formato chave-valor, como ?cor=verde, em vez de valor solto na URL, porque esse padrão é mais previsível de interpretar tanto para o buscador quanto para quem lê o endereço.
Parâmetro duplicado, como ?tipo=doce&tipo=azedo, também deve ser evitado. O formato correto agrupa os valores, como ?tipo=doce,azedo, numa única chave.
Parâmetro temporário, como identificador de sessão, código de rastreamento de campanha ou carimbo de tempo, nunca deveria gerar uma versão indexável da página, porque cria uma URL nova a cada visita sem nenhum ganho de conteúdo real.
Analítico de campanha, como o parâmetro que identifica de onde veio o clique de um anúncio, é exemplo comum disso. A página de destino continua sendo a mesma para efeito de conteúdo, e o canonical precisa apontar para a URL sem esse parâmetro, mesmo que o link do anúncio o inclua.
Isso não significa deixar de rastrear a origem do clique. A ferramenta de analítico continua registrando o parâmetro normalmente; o que muda é só qual URL o Google deve considerar a versão preferida para efeito de indexação.
Como tratar variação de produto
Para variante de produto, como cor ou tamanho, a documentação do Google aceita duas formas: um segmento de caminho, como /camiseta/verde, ou um parâmetro de consulta, como /camiseta?cor=verde. As duas formas são válidas tecnicamente.
A recomendação é usar a versão sem parâmetro como a URL canônica, e as variações levarem a marcação apontando de volta para ela, a menos que cada variante tenha volume de busca próprio relevante o suficiente para justificar página independente indexável.
Um exemplo prático: se camiseta verde e camiseta azul têm busca relevante cada uma, individualmente, faz sentido cada cor virar página indexável própria, com título e descrição específicos. Se ninguém busca pela cor especificamente, a versão genérica do produto basta, e as cores ficam como seleção dentro da mesma página, sem gerar URL indexada separada para cada uma.
Ferramenta de pesquisa de palavra-chave ajuda a responder essa pergunta antes de decidir. Vale checar o volume de busca do termo com a cor inclusa antes de investir tempo criando página indexada para cada variação de produto.
Produto sem estoque e categoria vazia
Categoria sem nenhum item, segundo a documentação oficial do Google, deve usar a tag noindex enquanto estiver vazia. Isso vale para categoria sazonal, que fica sem produto entre uma temporada e outra, e para categoria nova que ainda não recebeu nenhum item cadastrado.
Produto removido em definitivo é diferente: se o site apaga a página automaticamente, o correto é essa URL responder 404, não noindex. A distinção importa porque noindex sinaliza algo temporário, enquanto 404 sinaliza remoção definitiva, e usar o código errado confunde o rastreamento do Google sobre o que fazer com aquela URL no futuro. Manter noindex por meses num produto que nunca vai voltar é desperdício de rastreio que poderia ir para página nova.
Produto que volta ao estoque em poucos dias é candidato a manter a página no ar, sem noindex, mostrando a informação de indisponibilidade temporária. Isso evita que o cliente que já linkou ou salvou aquela URL encontre uma página removida.
Vale também sugerir produto parecido na própria página de indisponível, em vez de deixar o visitante sem nenhuma alternativa. Isso ajuda tanto a experiência de quem chega quanto a retenção do valor de SEO que aquela URL já acumulou ao longo do tempo em que esteve no ar recebendo visita e link.
Paginação de categoria
Cada página de resultado dentro de uma categoria precisa de URL própria e indexável, nunca a mesma URL servindo conteúdo diferente conforme algum estado de sessão do visitante.
Página dois, três e seguintes de uma categoria grande continuam sendo conteúdo legítimo e podem ranquear por conta própria, desde que cada uma tenha URL exclusiva. O erro comum aqui é aplicar canonical de toda paginação para a primeira página, o que faz o Google ignorar o conteúdo das páginas seguintes.
Categoria que carrega produto extra por rolagem infinita, sem trocar a URL, também esconde conteúdo do Google, porque o rastreador não rola a página como uma pessoa faria. Garantir que exista uma versão com URL tradicional, mesmo que a rolagem infinita continue ativa para quem visita, resolve esse problema específico e mantém a experiência de navegação inalterada.
Erros comuns
Bloquear URL de filtro via robots.txt, em vez de usar canonical, é o erro mais frequente, e a própria documentação do Google alerta contra essa prática especificamente. Isso costuma acontecer quando alguém encontra conselho antigo, de blog desatualizado, recomendando bloqueio de parâmetro como solução rápida.
Usar noindex em página de produto que já saiu de linha, em vez de 404, vem logo depois. Isso mantém a URL visível do ponto de vista técnico por mais tempo que o necessário, mesmo que o Google acabe removendo do índice de qualquer forma, com atraso maior do que se o código de resposta correto tivesse sido usado desde o começo.
Outros erros frequentes:
- Aplicar canonical de todas as páginas de paginação para a primeira página da categoria, escondendo produto que só aparece nas páginas seguintes.
- Gerar URL nova para parâmetro de rastreamento de campanha, sem excluir do índice.
- Deixar o menu interno do site linkar para versão filtrada em vez da versão canônica, o que reafirma o sinal errado a cada nova página do site.
- Não confirmar se um redirecionamento foi aplicado corretamente quando um produto muda de URL depois de uma reforma de categoria.
Se a sua loja tem filtro e ordenação gerando URL duplicada, esse é um dos primeiros pontos que conferimos no SEO para e-commerce, e a análise inicial é gratuita.
Perguntas frequentes
Filtro de loja virtual sempre gera conteúdo duplicado?
Gera variação de URL sempre, mas só vira problema real quando essas variações competem com a página principal por indexação, sem canonical apontando para a versão certa.
Robots.txt resolve o problema de filtro?
Não é o método recomendado. A documentação do Google alerta que ele pode continuar indexando URL bloqueada em robots.txt, sem o conteúdo. Canonical é o método correto.
Preciso reescrever a plataforma da loja para aplicar isso?
Raramente. A maioria das plataformas de e-commerce já permite configurar canonical e noindex pelo painel administrativo ou por plugin, sem exigir desenvolvimento personalizado.
Corrigir isso melhora a posição das páginas de categoria?
Costuma ajudar, porque consolida o sinal de várias URLs numa só, em vez de diluí-lo entre dezenas de versões filtradas. O ganho varia conforme o tamanho do catálogo e quantas combinações de filtro existiam antes.
Produto sem estoque deve sair do ar?
Depende do prazo. Fora de estoque temporário mantém a página, sem noindex. Produto removido em definitivo deve responder 404, não noindex.
Preciso de URL própria para cada página de paginação?
Precisa. Cada página de resultado numa categoria grande precisa de URL exclusiva e indexável, sem canonical apontando tudo para a primeira página da lista.
Variante de produto, como cor, precisa de página própria?
Pode usar segmento de caminho ou parâmetro, mas a versão sem parâmetro deve ser a canônica, a menos que a variante tenha demanda de busca própria relevante.
Como saber se meu e-commerce tem esse problema hoje?
O relatório de cobertura do Search Console mostra páginas excluídas por serem consideradas duplicadas, o que costuma revelar filtro e parâmetro sem canonical correto. Vale filtrar esse relatório pelo padrão de URL da loja, como o caminho de categoria, para achar o volume real de páginas afetadas.
Por onde começar
O problema técnico mais comum em e-commerce não é falta de otimização de conteúdo, é o próprio site multiplicando URL de forma que compete contra si mesmo pela mesma busca. Isso vale tanto para loja grande quanto pequena, e costuma passar despercebido até uma auditoria técnica revelar o tamanho real do problema.
O critério que deve orientar qualquer correção: canonical para consolidar sinal, nunca robots.txt, e código de status correto para cada situação de produto, seja fora de estoque ou removido em definitivo. Nenhuma dessas correções exige refazer o site do zero.
Auditoria técnica de e-commerce costuma revelar esse tipo de problema em minutos, quando se sabe exatamente onde procurar. Se você quer saber se a sua loja tem esse tipo de duplicação, gravamos uma análise gratuita mostrando o que encontramos, sem custo e sem compromisso.