O que é indexação?
Indexação é o processo em que o Google analisa o conteúdo de uma página e a armazena em seu índice, o grande banco de dados que alimenta os resultados de busca. Em inglês, o termo é indexing, e no dia a dia do mercado brasileiro a expressão aparece como indexação no Google.
O índice funciona como o catálogo de uma biblioteca gigante. Quando alguém pesquisa, o Google consulta esse catálogo em milésimos de segundo e monta a SERP com as páginas mais relevantes. Uma página fora do índice simplesmente não existe para a busca orgânica, por melhor que seja o conteúdo.
A indexação é a segunda etapa do caminho até o ranqueamento. Primeiro o robô rastreia a página, depois o Google a analisa e decide se ela entra no índice, e só então a página passa a concorrer a posições nos resultados.
Como funciona na prática?
Depois de rastrear uma página, o Google processa o conteúdo: lê o texto, os títulos, as imagens e os dados estruturados, identifica o assunto e verifica se a página é a versão principal de um conteúdo ou uma duplicata. Nessa análise, o Google escolhe a URL canônica, a versão que representa o grupo de páginas semelhantes, e é essa versão que entra no índice.
Algumas diretivas técnicas controlam o processo. A tag noindex pede que a página fique fora do índice. A tag canonical sugere qual URL deve ser tratada como principal. Páginas com conteúdo muito raso, duplicado ou de baixa qualidade podem ser rastreadas e mesmo assim ficar de fora, por decisão do próprio Google.
Para acompanhar tudo isso, o Google Search Console oferece o relatório de indexação de páginas, que mostra quais URLs estão no índice e o motivo das exclusões, e a ferramenta de inspeção de URL, que detalha a situação de cada página individual.
Indexação vs rastreamento: qual a diferença?
| Critério | Rastreamento | Indexação |
|---|---|---|
| O que acontece | O robô visita e baixa a página | O Google analisa e armazena a página no índice |
| Ordem | Vem primeiro | Vem depois do rastreamento |
| Controle do site | robots.txt e links | Tag noindex e canonical |
| Resultado | Página conhecida pelo Google | Página apta a aparecer na busca |
Veredito: o rastreamento é a visita do robô, e a indexação é a decisão de guardar a página no índice, portanto só a indexação coloca sua página no jogo da busca.
Exemplos de uso
- Uma loja virtual publica uma página de promoção e usa a inspeção de URL do Google Search Console para solicitar a indexação, reduzindo o tempo até aparecer na busca.
- Um site institucional descobre que a página de serviços ficou fora do índice porque uma tag noindex foi esquecida após a homologação do site novo.
- Um blog com artigos duplicados em duas URLs configura a tag canonical para concentrar a indexação na versão principal.
Erros comuns
- Publicar o site com a tag noindex herdada do ambiente de testes e só perceber semanas depois.
- Assumir que toda página publicada será indexada automaticamente, sem acompanhar o relatório de indexação.
- Bloquear a página no robots.txt e esperar que a tag noindex funcione, quando o robô nem consegue ler a tag.
- Criar dezenas de páginas quase idênticas e se surpreender quando o Google indexa só uma parte delas.
Perguntas frequentes sobre indexação
Como sei se minha página está indexada no Google?
Dois caminhos rápidos. Na busca, digite site: seguido da URL da página; se ela aparecer, está no índice. No Google Search Console, a ferramenta de inspeção de URL mostra o status oficial, com detalhes sobre rastreamento, canônica escolhida e eventuais impedimentos. O relatório de indexação de páginas dá a visão geral do site.
Quanto tempo o Google demora para indexar uma página?
Não existe prazo fixo. Páginas de sites com rastreamento frequente podem entrar no índice em horas, enquanto sites novos ou com pouca autoridade podem esperar dias ou semanas. Você acelera o processo mantendo o sitemap atualizado, linkando a página nova a partir de páginas fortes e solicitando a indexação na inspeção de URL.
Por que minha página foi rastreada mas não indexada?
O Google rastreia mais páginas do que indexa. Os motivos mais comuns de exclusão são conteúdo duplicado com outra URL escolhida como canônica, conteúdo considerado raso ou de baixa qualidade e diretivas técnicas como a tag noindex. O relatório de indexação do Google Search Console informa o motivo específico de cada URL excluída.