Existem centenas de checklists de SEO técnico circulando, e quase todos têm o mesmo defeito: listam sessenta itens sem dizer quais importam. O resultado é um time que passa três semanas corrigindo atributos de imagem enquanto metade do site não está indexada.
Este é organizado por impacto. Os primeiros itens determinam se você existe na busca. Os últimos são refinamentos que só valem quando o resto está resolvido.
Se você só tiver tempo para uma seção, faça a primeira.
Um diagnóstico de uma hora
Antes de percorrer as camadas, vale uma passada rápida que revela onde está o problema. Sete verificações, cinco a dez minutos cada.
1. Quantas páginas estão indexadas? Compare o número no Search Console com o total de URLs no sitemap. Se a diferença passa de 20%, a camada 1 tem problema e é onde você deve gastar o tempo.
2. A home aparece para o nome da empresa? Busque pelo nome exato. Se a home não é o primeiro resultado — ou se aparece outra página do seu site — há algo errado em canonicidade ou em estrutura interna.
3. O texto principal está no código-fonte? Abra o fonte original de uma página de conteúdo e procure o H1. Trinta segundos, e responde a maior dúvida sobre renderização.
4. Um endereço inexistente devolve 404? Digite uma URL aleatória do seu domínio. Se aparecer a home, você tem soft 404.
5. Quantos saltos até a URL final? Acesse a versão sem HTTPS e sem www e conte os redirecionamentos. Mais de um é desperdício.
6. A página abre sem JavaScript? Desative o JS no navegador e recarregue uma listagem. Se ficar em branco, o conteúdo depende de execução.
7. Os rastreadores estão liberados? No painel do provedor ou do serviço de proteção, confira se há bloqueio de bots. Não no robots.txt — na camada acima dele.
Ao fim dessas sete, você sabe em qual camada concentrar. É mais útil que qualquer relatório automatizado de cem páginas, porque cada resposta aponta para uma ação específica.
Camada 1 — Existir no índice
Nada abaixo desta seção importa se as páginas não estão indexadas. E este é o problema mais comum e o menos investigado.
Confirme o que está indexado
No Search Console, o relatório de páginas divide as URLs entre indexadas e não indexadas, com o motivo de cada exclusão. Comece por aí, não por ferramenta de terceiro.
Dois status merecem atenção especial, e eles significam coisas diferentes:
"Descoberta — não indexada no momento" significa que o Google conhece a URL e nem chegou a rastrear. Costuma indicar limitação de orçamento de rastreamento, ou que o site não passou confiança suficiente para valer a visita.
"Rastreada — não indexada no momento" é mais grave. O Google visitou, leu, e decidiu que a página não acrescenta nada ao que já existe. Isso é um problema de conteúdo, não de configuração — e nenhum ajuste técnico resolve.
Verifique os bloqueios acidentais
Quatro coisas que removem páginas do índice sem ninguém perceber:
- `noindex` esquecido de um ambiente de homologação que foi para produção
- `Disallow` no robots.txt bloqueando um diretório inteiro por engano
- Canonical apontando para outra página — a página existe e diz ao Google para indexar outra
- Autenticação ou bloqueio de bot em camada de servidor ou CDN
Esse último merece destaque porque cresceu muito. Serviços de proteção passaram a bloquear rastreadores por padrão — inclusive os de sistemas de IA, e às vezes o do próprio buscador em modo agressivo. É uma configuração no painel do provedor, acima do robots.txt, e quase ninguém confere.
Cuidado com a sintaxe do robots.txt
Um erro sutil e frequente: diretivas pertencem ao grupo `User-agent` que as precede, não ao arquivo inteiro. Se você tem vários blocos e coloca os `Disallow` no final, eles se aplicam apenas ao último grupo.
Cada grupo precisa das próprias regras, separados por linha em branco.
Pegue cinco URLs importantes do site e pesquise cada uma no Google usando a busca restrita ao endereço exato. Se alguma não aparecer, você tem um problema de indexação — e ele vale mais que qualquer otimização.
Camada 2 — Ser renderizado corretamente
O conteúdo existe sem JavaScript?
Muito site moderno monta o conteúdo no navegador. O Google renderiza JavaScript, mas em uma segunda passada, com atraso e sem garantia. E vários outros rastreadores — incluindo os de sistemas de resposta por IA — não executam nada.
O teste: abra a página, veja o código-fonte original (não o inspetor de elementos, que mostra o resultado depois da execução) e procure o texto do seu H1 e dos primeiros parágrafos. Se não estiver lá, há risco.
Um caso que passa despercebido: conteúdo que está no HTML mas fica invisível por CSS até o JavaScript revelar. Animações de entrada com `opacity: 0` são o exemplo clássico. O texto existe para o rastreador, mas se um humano com JavaScript desativado vê a página em branco, algo está errado — e o comportamento de sistemas que avaliam renderização é imprevisível.
A correção é o padrão de melhoria progressiva: o CSS só esconde depois que o JavaScript provou que está rodando.
O servidor responde com o status certo?
Três erros de status que causam dano real:
Soft 404. URL inexistente que devolve a home com status 200. O buscador trata como página válida e indexa lixo. É comum em configuração de servidor que aponta o erro 404 para a página inicial.
Redirecionamento em cadeia. HTTP vira HTTPS, que vira www, que vira a URL final. Três saltos onde deveria haver um. Custa requisições e dilui sinal.
Redirecionamento para a home. Páginas removidas apontando para a raiz. O buscador trata como erro, não como redirecionamento legítimo. O destino correto é a página equivalente, ou um 410 assumindo que ela se foi.
Camada 3 — Não competir consigo mesmo
Uma versão canônica do site
O mesmo conteúdo acessível em `http://`, `https://`, com e sem `www`, com e sem barra final, e com parâmetros de campanha. São seis versões da mesma página se nada estiver configurado.
A regra: escolha uma forma, redirecione todas as outras para ela em um único salto, e garanta que o canonical de cada página aponte para si mesma nessa forma.
Canonical coerente
Três erros comuns: canonical ausente, canonical apontando para a home em todas as páginas (o que pede ao Google para ignorar o site inteiro), e canonical em uma forma diferente da que o site de fato usa.
Verifique que o endereço no canonical bate exatamente com a URL da página — mesmo protocolo, mesmo host, mesma barra final.
Canibalização
Duas páginas suas competindo pela mesma busca dividem os sinais e produzem posições instáveis. No Search Console, clique em uma consulta e veja a aba de páginas: se duas URLs aparecem com impressões relevantes, elas estão competindo.
Camada 4 — Velocidade, com foco
Core Web Vitals importa, e o esforço costuma ser mal distribuído. Em quase todo site B2B, o item que falha é o tempo até o maior elemento visível aparecer — normalmente a imagem principal ou o bloco de texto do topo.
As correções de maior retorno, em ordem:
- Servir a imagem principal do próprio domínio, em formato moderno. Depender de host de terceiro significa que a velocidade do seu site depende da velocidade dele.
- Marcar a imagem do topo com prioridade alta e nunca com carregamento tardio. É o erro mais comum: aplicar `lazy` em todas as imagens, inclusive na que define a métrica.
- Declarar largura e altura em todas as imagens. Sem isso o layout se desloca enquanto carrega.
- Externalizar o CSS. Estilo embutido em cada página não pode ser cacheado entre páginas — o visitante baixa o mesmo conteúdo a cada clique.
- Remover script de terceiro que ninguém usa. Ferramentas de análise abandonadas continuam carregando.
Um cuidado sobre otimização de velocidade: acima de certo ponto, o ganho é marginal e o esforço cresce muito. Sair de doze segundos para três muda tudo; sair de dois para 1,7 não muda quase nada. Não gaste semanas na segunda faixa enquanto a primeira camada desta lista tem problemas.
Camada 5 — Estrutura e navegabilidade
Nenhuma página órfã
Página que só existe no sitemap, sem nenhum link interno apontando, recebe pouca prioridade de rastreamento e nenhum sinal de importância. Toda página que deve ranquear precisa de pelo menos um link contextual.
É especialmente comum em conteúdo novo publicado em uma seção nova: o artigo existe, está no sitemap, e nada no site aponta para ele.
Sitemap segmentado e limpo
Um sitemap por tipo de página — home, categorias, artigos — sob um índice. Com isso, o relatório do Search Console mostra a taxa de indexação por segmento, o que transforma um número agregado inútil em diagnóstico.
Duas regras: nenhuma URL em dois sitemaps ao mesmo tempo, e nenhuma URL com `noindex` ou redirecionamento dentro deles.
Hierarquia de títulos coerente
Um H1 por página, sem pular níveis. Não é fator de ranqueamento forte, e importa para acessibilidade e para sistemas que extraem trechos por seção.
Links internos com texto descritivo
"Clique aqui" e "saiba mais" não comunicam nada. O texto do link é um dos sinais mais diretos que você controla sobre o tema da página de destino.
Camada 6 — Dados estruturados
É o item de melhor relação entre esforço e retorno em quase todo site B2B, porque quase ninguém faz direito.
O que vale marcar:
- `Article` em cada conteúdo, com autor, datas e seção
- `BreadcrumbList` — se o breadcrumb existe visualmente, marcá-lo é trivial
- `Person` para o autor, com `sameAs` apontando para perfis reais
- `Organization` e `WebSite` na home
- `FAQPage` onde houver perguntas frequentes
Três cuidados que evitam problema:
O que está no schema precisa estar visível na página. Marcar um `FAQPage` com perguntas que não aparecem para o usuário viola as diretrizes e pode gerar ação manual.
Não declare o que não é verdade. Um `wordCount` inflado ou uma data de modificação que não corresponde a mudança real são afirmações verificáveis e incorretas feitas diretamente ao buscador. Isso é pior que não ter schema.
Valide antes de publicar em escala. Um erro replicado em cem páginas é caro de corrigir.
Camada 7 — Refinamentos
Só chegue aqui quando as anteriores estiverem resolvidas.
Tamanho de título. O buscador exibe cerca de sessenta caracteres. Sufixos longos de marca — "— Empresa X, especialistas em Y" — nunca aparecem e ocupam o espaço do título real.
Meta description. Não é fator de ranqueamento, é fator de clique. Entre 120 e 160 caracteres, descrevendo o que a página entrega.
Alt text que descreve. Não a palavra-chave repetida, mas o que a imagem mostra. E precisa corresponder à imagem — alt herdado de um template é erro que passa despercebido em site inteiro.
Cabeçalhos de segurança e HTTPS correto. Sem conteúdo misto, sem certificado expirando.
Página 404 útil. Com status 404 de verdade, conteúdo próprio e caminhos de volta.
Sobre relatórios automatizados
Ferramentas de auditoria produzem listas longas com pontuação e severidade. São úteis e precisam ser lidas com critério.
O que elas fazem bem: encontrar links quebrados em volume, mapear a estrutura de links internos, detectar títulos e descriptions duplicados, e localizar páginas órfãs. Trabalho mecânico em escala que ninguém faz à mão.
O que elas fazem mal: priorizar. A lista costuma vir ordenada por severidade calculada por um critério genérico, que não conhece o seu contexto. Um site com problema grave de indexação recebe a mesma lista de "otimizar imagens" que um site perfeitamente indexado.
O que elas não veem: se o conteúdo presta. Nenhuma ferramenta detecta que cem páginas compartilham 70% do texto entre si, ou que um artigo responde à pergunta errada. O status "rastreada — não indexada" é o buscador dizendo exatamente isso, e ferramenta nenhuma explica.
Um viés que vale conhecer: relatórios tendem a inflar a contagem de problemas, porque uma lista longa justifica a assinatura. Itens como "imagem sem alt em ícone decorativo" ou "título com 63 caracteres" entram na contagem com o mesmo peso de coisas que importam.
Use a ferramenta para o trabalho mecânico e a sua cabeça para a ordem. Se o relatório aponta 340 problemas, provavelmente uns oito importam.
A rotina que impede a degradação
Auditoria completa uma vez por ano e nada no meio produz um site que degrada em silêncio. Três rotinas leves sustentam:
Semanal, cinco minutos. Abrir o Search Console e olhar se apareceu erro novo de indexação ou de dados estruturados.
Mensal, trinta minutos. Verificar a taxa de indexação por segmento do sitemap. Uma queda em um segmento é diagnóstico.
A cada publicação. Confirmar que a página nova tem canonical correto, ao menos um link interno apontando, e está no sitemap certo. Três verificações de um minuto que evitam a maior parte dos problemas.
O caso especial da migração
Uma situação em que a ordem das camadas muda: quando o site vai mudar de endereço, de estrutura de URL ou de plataforma.
Migração é o momento de maior risco em SEO técnico. Um erro aqui apaga anos de histórico, e o dano só aparece semanas depois — quando é caro reverter.
A sequência que reduz o risco:
Antes. Exporte a lista completa de URLs atuais com impressões e cliques dos últimos doze meses. É essa lista que você vai usar para conferir depois, e ela deixa de existir no dia da migração. Exporte também o perfil de links externos, para saber quais URLs não podem quebrar.
Mapeie um para um. Cada URL antiga precisa de um destino explícito. Redirecionar tudo para a home é o erro clássico e destrutivo — o buscador trata como erro, não como migração.
Para URLs cujo conteúdo deixou de existir, o correto é 410, não redirecionamento para algo vagamente relacionado.
Teste em ambiente separado, com o mapa completo, antes de trocar.
No dia. Verifique uma amostra de cinquenta redirecionamentos manualmente. Confirme que cada um resolve em um salto e chega ao destino certo.
Depois. Envie o sitemap novo, mantenha o antigo acessível por algumas semanas, e acompanhe a taxa de indexação diariamente na primeira quinzena.
Uma expectativa a calibrar: é normal perder tráfego por algumas semanas, mesmo em migração bem feita. O buscador precisa reprocessar tudo. Se a queda passar de dois meses sem recuperação, aí sim há problema — e o primeiro lugar a olhar é o mapa de redirecionamentos.
Uma migração de URL só se justifica quando vem acompanhada de mudança real: reestruturação de conteúdo, plataforma nova, consolidação de páginas. Trocar endereço apenas para ter um slug mais bonito custa mais do que rende.
A armadilha da checagem vazia
Um alerta que vale mais que vários itens desta lista, e que aprendi errando.
Muita verificação automatizada é escrita no formato "para cada X, confirme que X está correto". Esse formato passa silenciosamente quando não existe nenhum X.
Exemplos concretos: "todo link de CSS deve resolver" passa numa página sem CSS nenhum. "Toda imagem deve ter alt" passa numa página sem imagens. "Todo canonical deve apontar para si mesmo" passa numa página sem canonical.
A correção é sempre parear a checagem de consistência com uma de presença: primeiro confirme que o elemento existe, depois que ele está correto. Vale revisar as suas verificações atuais com esse critério — costuma aparecer pelo menos uma passando por vacuidade.
A ordem, resumida
| # | Camada | Se estiver errada |
|---|---|---|
| 1 | Indexação | O site não existe na busca |
| 2 | Renderização e status | O conteúdo não é lido, ou lixo é indexado |
| 3 | Canonicidade | Você compete consigo mesmo |
| 4 | Velocidade | Perde visitante e um pouco de posição |
| 5 | Estrutura | Páginas boas recebem pouca prioridade |
| 6 | Dados estruturados | Perde exibição especial e citação em IA |
| 7 | Refinamentos | Perde cliques |
A tentação é sempre começar pela camada 7, porque é a mais fácil de executar e a que produz uma lista visível de tarefas concluídas. É também a que menos muda resultado. Se as três primeiras camadas têm problema, corrigir título e alt text não vai mover nada.
Perguntas frequentes
Por onde começar uma auditoria de SEO técnico?
Pela indexação. Nada abaixo disso importa se as páginas não estão no índice. Compare o número de páginas indexadas no Search Console com o total do sitemap; se a diferença passa de 20%, é aí que o tempo deve ser gasto.
O que é soft 404 e por que é um problema?
É uma URL inexistente que devolve conteúdo válido com status 200 — normalmente a página inicial. O buscador trata como página real e indexa lixo. Acontece quando a configuração do servidor aponta o erro 404 para a home.
Meu site depende de JavaScript. Isso prejudica o SEO?
O Google renderiza JavaScript, mas numa segunda passada com atraso e sem garantia, e vários outros rastreadores não executam nada. Verifique se o texto do H1 aparece no código-fonte original. Atenção também a conteúdo que existe no HTML mas fica invisível por CSS até o JS revelar.
Quais itens de velocidade dão mais retorno?
Servir a imagem principal do próprio domínio em formato moderno, marcá-la com prioridade alta em vez de carregamento tardio, declarar largura e altura em todas as imagens, externalizar o CSS e remover scripts de terceiro abandonados.


