Checklist de SEO técnico, o que conferir e em que ordem
SEO técnico é o trabalho de garantir que o buscador consiga encontrar, ler, entender e indexar as suas páginas. Ele vem antes de conteúdo e de links, porque nada do que você escreve tem efeito se a página não chega ao índice. A ordem de correção importa mais que a lista: primeiro o que impede o acesso, depois o que atrapalha o entendimento, por último o refinamento.
- A sequência é sempre a mesma: descoberta, rastreamento, renderização, indexação e exibição
- Página bloqueada no robots.txt não é rastreada, e ninguém recebe aviso disso
- Robôs de busca com IA não executam JavaScript: conteúdo montado no navegador não existe para eles
- Rastreada mas não indexada é um recado sobre qualidade, não um erro técnico
- Redirecionamento em cadeia e erro 404 desperdiçam sinal que já era seu
- Corrigir na ordem errada consome semanas sem mover nada
Auditoria técnica costuma virar uma lista de quatrocentos itens que ninguém termina. O problema quase nunca é a falta de lista: é a falta de ordem.
Este guia mostra o que conferir em cada etapa, como identificar o que está travando e qual a sequência que rende mais por hora de trabalho.
O que é SEO técnico
SEO técnico é o conjunto de ajustes na estrutura do site que permitem ao buscador acessar e interpretar o conteúdo. Ele não trata do que está escrito. Cuida de tudo que precisa funcionar para que o escrito seja lido.
A separação ajuda a decidir prioridade. Conteúdo excelente em página bloqueada rende zero, enquanto conteúdo mediano em página bem servida ao menos entra na disputa.
Na prática, a maior parte do trabalho técnico de um site pequeno cabe em poucas frentes: indexação, velocidade, estrutura de URLs e dados estruturados. Site grande acrescenta orçamento de rastreamento e controle de duplicação.
Uma boa notícia raramente dita: problema técnico costuma ser pontual e ter conserto definitivo. Diferente de conteúdo, que exige manutenção permanente.
A ordem que resolve: descoberta, rastreio, renderização, indexação
O caminho de uma página até o resultado de busca tem cinco etapas encadeadas, e cada uma depende da anterior. Entender a corrente evita corrigir o elo errado.
| Etapa | O que acontece | O que trava aqui |
|---|---|---|
| Descoberta | O buscador fica sabendo que a URL existe | Página sem link interno e fora do sitemap |
| Rastreamento | O robô baixa o conteúdo da página | Bloqueio no robots.txt, no servidor ou no WAF |
| Renderização | O conteúdo montado por JavaScript é processado | Conteúdo que só existe depois do script rodar |
| Indexação | A página entra no índice do buscador | Marcação de não indexar, duplicação, baixa qualidade |
| Exibição | A página aparece para alguma busca | Relevância e concorrência |
Traduzindo a tabela: não adianta trabalhar exibição se a página trava na descoberta. E o diagnóstico correto quase sempre começa no relatório de indexação, que diz em qual etapa a corrente arrebentou.
Esse encadeamento também explica um erro comum de leitura. Uma página que não aparece na busca pode estar em qualquer um dos cinco estágios, e o tratamento é diferente em cada um.
O Google está encontrando as suas páginas
A descoberta acontece por dois caminhos: links que apontam para a página e sitemap declarando que ela existe. Uma página sem nenhum dos dois pode simplesmente nunca ser encontrada.
O que conferir:
- O sitemap existe, está declarado no robots.txt e lista apenas URLs que respondem 200
- Nenhuma URL do sitemap redireciona, porque isso confunde o sinal do que é canônico
- Toda página importante recebe pelo menos um link interno de outra página
- A profundidade de clique é razoável: nada essencial a mais de três cliques da home
- As páginas novas aparecem em alguma listagem que o robô visita com frequência
O segundo item costuma estar errado sem ninguém notar. Sitemap gerado automaticamente continua listando páginas que viraram rascunho ou mudaram de endereço, e isso desperdiça rastreamento.
Página órfã é o caso mais silencioso. Ela existe, tem conteúdo bom e nenhuma outra página do site aponta para ela, então o buscador visita raramente ou nunca.
O que bloqueia o rastreamento sem ninguém perceber
Rastreamento é a etapa em que mais gente se engana, porque o bloqueio pode estar em três camadas diferentes e só uma delas é visível no site.
O robots.txt e o que ele realmente faz
O robots.txt diz aos robôs o que eles não devem rastrear, e é a primeira coisa que qualquer robô consulta. Ele não impede indexação por si só: uma URL bloqueada pode aparecer no índice sem conteúdo, se receber links.
O que conferir nele:
- Nenhum bloqueio herdado de ambiente de testes, como um bloqueio geral esquecido
- Arquivos de CSS e JavaScript liberados, porque o buscador precisa deles para renderizar
- O sitemap declarado, com o endereço completo
- Regras por robô conferidas uma a uma, principalmente as que citam agentes de IA
O último item ganhou peso. Bloquear os robôs de busca das IAs, como os que alimentam ChatGPT e Perplexity, tira o site das respostas geradas por essas ferramentas.
Quando o bloqueio está no servidor, e não no robots
Este é o caso mais difícil de achar: o robots.txt libera e o servidor recusa. Firewall de aplicação, proteção de rede e regras do próprio host devolvem erro para robôs que consideram suspeitos.
O sintoma é confuso: você abre a página no navegador e funciona, e o relatório de rastreamento acusa falha. A diferença é o robô que pediu.
O teste é simples e raramente feito: solicitar a página informando o nome do robô no cabeçalho de identificação e conferir o código de resposta. Um 403 ali é bloqueio de servidor, não de conteúdo.
Esse tipo de bloqueio costuma nascer de uma configuração de segurança bem-intencionada, e ninguém revisa depois.
Renderização: quando o JavaScript apaga o seu conteúdo
A indexação do Google acontece em duas ondas: primeiro o HTML bruto, depois a renderização do JavaScript, que pode demorar. Conteúdo que só aparece na segunda onda entra mais tarde e nem sempre entra.
Para os robôs que alimentam as respostas com inteligência artificial o problema é maior, porque boa parte deles não executa JavaScript. Para eles, a página existe apenas na versão bruta.
O teste que qualquer um consegue fazer: abra o código-fonte da página, sem inspecionar elementos, e procure um trecho do seu texto principal. Se ele não estiver ali, o conteúdo depende de script.
O que resolve, em ordem de esforço:
- Servir o conteúdo principal já no HTML, com renderização no servidor ou geração estática
- Garantir que título, subtítulos e primeiro parágrafo nunca dependam de script
- Deixar para o JavaScript apenas o que é interação, e não o que é conteúdo
Site em WordPress com tema tradicional raramente tem esse problema. Ele aparece em sites feitos em frameworks modernos sem renderização no servidor.
Por que uma página rastreada não entra no índice
Rastreada mas não indexada é o diagnóstico mais mal interpretado do relatório de indexação. Não é falha técnica: é o buscador dizendo que não achou a página digna de ocupar espaço.
As causas mais comuns:
- Conteúdo raso, que não responde nada que já não esteja respondido em outro lugar
- Página quase idêntica a outra do próprio site
- Página gerada em escala, como combinações automáticas de filtro ou de cidade
- Página sem nenhum link interno, que sinaliza pouca importância dentro do site
O caminho não é pedir indexação manualmente. Isso trata o sintoma e o problema volta na próxima avaliação.
O que funciona é aumentar a profundidade real da página, consolidar o que estiver repetido e dar link interno a partir de páginas relevantes. Quando a página não tiver conserto, o certo é removê-la e redirecionar.
Vale conhecer também o outro lado: as práticas que violam as políticas de spam geram exclusões parecidas e exigem tratamento diferente.
Canonical, duplicação e páginas quase iguais
A tag canonical informa qual é a versão oficial de um conteúdo que existe em mais de um endereço. Ela resolve duplicação sem precisar apagar nada.
O que conferir:
- Toda página tem canonical, e nas páginas principais ela aponta para ela mesma
- Versões com e sem www e com e sem barra final resolvem para um único endereço
- Parâmetros de rastreamento de campanha não geram versões indexáveis diferentes
- Paginação não repete o mesmo canonical da primeira página em todas as demais
O terceiro item derruba muito site de e-commerce. Filtros de cor, tamanho e ordenação criam dezenas de URLs com o mesmo conteúdo.
Um sinal de alerta fácil de checar: se o número de páginas indexadas for muito maior que o número de páginas que você sabe que existem, quase sempre há duplicação por parâmetro.
Redirecionamentos e erros que desperdiçam sinal
Redirecionamento existe para preservar o que uma URL já conquistou quando ela muda de endereço. Feito errado, ele desperdiça exatamente o que deveria preservar.
O que conferir:
- Nenhuma cadeia longa: uma URL antiga deve apontar direto para o destino final
- Redirecionamento para a página equivalente, e não para a home, que perde relevância
- Links externos antigos apontando para URLs que hoje respondem erro
- Erros 404 vindos de links internos, que são inteiramente culpa sua
- Nenhuma regra que mande todo endereço inexistente para a home, o que esconde problemas
O item 3 é o mais rentável de todos os itens desta lista. Um link conquistado anos atrás que hoje bate em erro é autoridade parada na porta, e o conserto é uma linha de configuração.
O item 5 merece atenção especial. Mandar todo 404 para a home parece elegante e produz um efeito ruim: o buscador passa a ver dezenas de endereços diferentes servindo o mesmo conteúdo.
Velocidade e estabilidade da página
Velocidade entra no SEO técnico como pré-requisito de experiência, medida por três indicadores a partir de visitantes reais. Eles avaliam tempo de carregamento, resposta ao toque e estabilidade do layout.
O que costuma resolver a maior parte em site pequeno:
- Comprimir e dimensionar corretamente a imagem principal de cada página
- Reduzir scripts de terceiros, começando pelos rastreadores duplicados
- Reservar espaço para imagens e banners, evitando o layout pular
- Cache de página configurado e hospedagem adequada ao volume
O detalhe de cada indicador, com limites e correções específicas, está no guia de Core Web Vitals, que trata só desse assunto.
Um alerta de prioridade: velocidade é importante e quase nunca é o que mais trava um site. Indexação bloqueada custa mais que meio segundo de carregamento.
Dados estruturados: o que vale marcar
Dados estruturados são um código que descreve o conteúdo em formato que o buscador lê sem ambiguidade. Eles não são requisito para aparecer nos recursos de IA, segundo a documentação do Google, e continuam úteis para resultados enriquecidos e clareza de entidade.
O que vale marcar na maioria dos sites:
- Organization ou LocalBusiness, com nome, endereço, telefone e perfis oficiais
- BreadcrumbList, que ajuda a exibir o caminho no resultado
- Article ou BlogPosting nos conteúdos, com autor e datas
- Product nas lojas, com preço, disponibilidade e avaliação real
- FAQPage onde existir pergunta e resposta visíveis na página
Marcar o que não está visível na página é violação de diretriz. A regra é simples: o código descreve o que existe, nunca acrescenta o que não existe.
O checklist em ordem de prioridade
A lista abaixo está na ordem de retorno por hora de trabalho, e não na ordem em que as ferramentas costumam apresentar.
| Prioridade | O que conferir | Por que primeiro |
|---|---|---|
| 1 | Marcação de não indexar em páginas importantes | Uma linha pode apagar o site inteiro da busca |
| 2 | Bloqueios no robots.txt e no servidor | Sem acesso, nada mais importa |
| 3 | Conteúdo presente no HTML sem depender de script | Robôs de IA não executam JavaScript |
| 4 | URLs do sitemap respondendo 200 | Sitemap sujo desperdiça rastreamento |
| 5 | Links externos apontando para páginas com erro | Recupera autoridade já conquistada |
| 6 | Canonical e duplicação por parâmetro | Evita o site competir consigo mesmo |
| 7 | Cadeias de redirecionamento | Preserva sinal em cada mudança |
| 8 | Páginas órfãs e profundidade de clique | Distribui força interna |
| 9 | Velocidade e estabilidade visual | Desempata resultados parecidos |
| 10 | Dados estruturados | Melhora a apresentação no resultado |
Traduzindo a tabela: os cinco primeiros itens resolvem se o seu site existe para o buscador. Os cinco últimos melhoram como ele aparece.
Quem tem meio dia por mês para SEO técnico deve gastar esse tempo nos cinco primeiros, sempre.
O item de checklist que nasceu de um erro nosso
Este item entrou na nossa lista depois de derrubarmos o blog de um cliente sem perceber.
Ao editar páginas de um site feito em construtor visual, apagamos os arquivos de CSS que o construtor gera, esperando que fossem regenerados sozinhos. Não foram. As páginas continuaram chamando seis arquivos de estilo que passaram a responder 404. Um deles era o do modelo usado por todos os posts, então o blog inteiro ficou sem formatação, com menu invisível e texto claro sobre fundo branco.
Nenhum relatório de SEO acusou nada, porque as páginas respondiam 200 normalmente.
Desde então, a auditoria técnica inclui um passo bobo e valioso: listar os arquivos de CSS e JS que o HTML referencia e testar um por um. Qualquer 404 ali significa página renderizando errada para usuário e para robô.
Com que frequência auditar
Auditoria completa uma ou duas vezes por ano resolve para a maioria dos sites. O que precisa de acompanhamento mensal é bem menor.
O que olhar todo mês, em poucos minutos:
- Exclusões novas no relatório de indexação do Google Search Console
- Ações manuais e problemas de segurança
- Erros 404 novos, principalmente vindos de links internos
O que checar depois de qualquer mudança grande, como redesenho, migração ou troca de plugin:
- O arquivo de robôs continua igual
- As URLs principais não mudaram de endereço sem redirecionamento
- O conteúdo continua presente no HTML bruto
- O sitemap foi regenerado e não lista páginas mortas
Migração de site é o momento em que mais tráfego se perde por descuido técnico, e quase sempre por um desses quatro pontos.
Perguntas frequentes
SEO técnico resolve sozinho o posicionamento?
Não. Ele é pré-requisito: garante que a página possa competir. Quem decide a posição é a relevância do conteúdo para a busca e a autoridade acumulada.
Preciso de programador para fazer SEO técnico?
Depende da plataforma. Em WordPress, boa parte da lista se resolve por configuração e plugin. Em site feito sob medida, os itens de renderização e cabeçalho exigem quem mexa no código.
Quantas páginas indexadas é o número certo?
Não existe número ideal. O saudável é que o total indexado seja próximo do total de páginas que você quer que existam. Muito acima disso costuma indicar duplicação.
Vale a pena bloquear robôs de IA no robots.txt?
É uma decisão de negócio. Bloquear os robôs de treino não tira o site das respostas; bloquear os robôs de busca dessas ferramentas tira. Trate os dois grupos separadamente.
Erro 404 prejudica o site?
Um 404 em uma página que realmente não existe mais é a resposta correta e não prejudica. O que prejudica é link interno apontando para erro e URL com histórico virando erro sem redirecionamento.
Com que rapidez uma correção técnica aparece?
Correções de bloqueio costumam aparecer em dias, assim que a página é rastreada de novo. Mudanças que dependem de reavaliação de qualidade levam semanas.
Por onde começar
O checklist de SEO técnico rende quando você respeita a ordem da corrente: descoberta, rastreio, renderização, indexação e só então exibição. Corrigir de trás para frente é o que faz auditoria virar lista infinita sem resultado.
O critério de prioridade é sempre o mesmo: comece pelo que impede o buscador de acessar a página, siga pelo que confunde o entendimento e deixe o refinamento para o fim. Quem tem pouco tempo deve gastá-lo nos cinco primeiros itens da tabela.
Se quiser um diagnóstico técnico do seu site com as correções já ordenadas por impacto, a equipe de SEO da Cloud Market faz uma análise gratuita e devolve em vídeo o que encontrou.