SEO técnico
Como indexar o site no Google
Indexar o site no Google é colocar a URL no índice da Busca. O pedido de indexação no Search Console é uma dica, não uma garantia. A descoberta vem de links e de sitemap. Conferir e corrigir o bloqueio importa mais do que reenviar a URL.
Por que a URL não entra
A URL não entra no índice quando o Google ainda não a descobriu, não conseguiu rastreá-la ou rastreou e decidiu não guardá-la. Site no ar, HTTP 200 no navegador e botão "Solicitar indexação" clicado não bastam: a maior parte das páginas listadas na Busca não foi submetida na mão.
A SERP brasileira sobre como indexar o site no Google quase sempre vende o atalho inverso. Envie a URL, espere, pronto. O que o Google declara é outra coisa: o pedido é uma dica para a fila de rastreio, a descoberta vem de links e de sitemap, e nem toda página que passa pelos requisitos entra no índice.
Indexar não é ranquear
Entrar no índice é o requisito para aparecer. Não é posição, não é clique e não é cliente. Uma URL indexada ainda pode não aparecer para a busca que você imagina, se o conteúdo for irrelevante para ela ou se a qualidade for baixa.
O mapa de rastreio, robots, sitemap, canonical e velocidade está no guia de o que é SEO técnico. Este texto aprofunda só a porta do índice: como a URL entra, como conferir, por que o Google recusa e o que o pedido de indexação realmente faz. O recorte de execução contínua desse trabalho está em serviços de SEO.
O que é indexação
- Indexação
- É a etapa em que o Google analisa o que foi rastreado e decide o que guardar no índice, o banco enorme de páginas que a Busca consulta quando alguém pesquisa. Sem índice, aquela URL não entra no resultado orgânico.
Durante a indexação o Google lê texto, imagens, vídeos, o <title> e os atributos alt, e tenta entender do que a página trata. Também decide se ela é cópia de outra e qual versão deve ser a canônica. A informação coletada pode ir para o índice. Pode não ir: a documentação de como a Busca funciona diz, com todas as letras, que a indexação não é garantida.
Três condições mínimas tornam a página elegível a ser indexada, segundo os requisitos técnicos da Pesquisa Google: o Googlebot não está bloqueado, a página responde HTTP 200 e o conteúdo é de um tipo que a Busca consegue ler, sem violar as políticas de spam. Elegível não é o mesmo que indexada. Custa nada entrar na Busca. Não existe fila paga.
O que a indexação não é
Não é cadastro em diretório. Não é "submeter o site" uma vez e esquecer. Não é posição. Não é o Search Console em si: o Console mostra o que o Google já registrou sobre a sua propriedade verificada. Quem decide o que entra no índice continua sendo o Google.
Rastreio vs índice vs SERP
A Busca opera em três estágios, e nem toda página completa os três: rastreamento, indexação e exibição dos resultados. O guia oficial está em How Google Search works. Google não garante crawl, índice ou serving mesmo quando a página segue as Search Essentials.
No rastreamento o Googlebot baixa a página e pode executar JavaScript com uma versão recente do Chrome. Se o conteúdo principal só nasce depois de um clique, de um login ou de um app shell vazio, o rastreador pode não vê-lo. No serving, a Busca consulta o índice e monta o resultado para aquela consulta, naquele dispositivo, naquele lugar. A Inspeção de URL pode dizer "O URL está no Google" e a página ainda assim não aparecer para a busca que você testa: a ajuda da ferramenta declara que esse status não garante exibição.
Em 30 segundos
Rastreada é "o bot passou". Indexada é "entrou no banco". Na SERP é "foi escolhida para aquela busca". Tratar as três como a mesma coisa é o erro que faz a pessoa clicar em Solicitar indexação quando o problema é outro.
Pedido de indexação: o que faz
- Pedido de indexação
- É o botão Solicitar indexação na Inspeção de URL do Search Console. Se a página passar numa verificação rápida de erros imediatos, ela entra na fila de indexação. Não é um comando, é uma dica para o rastreador olhar aquela URL.
A documentação Solicitar ao Google um novo rastreamento de URLs descreve o que o botão realmente faz. Serve para URL que você gerencia, não para a do concorrente. Há cota para envio individual. Pedir de novo o mesmo endereço não faz o rastreio acontecer mais rápido. O rastreamento pode levar de alguns dias a algumas semanas. Acompanhe pelo relatório de páginas ou pela própria Inspeção.
A ajuda da Ferramenta de inspeção de URL é ainda mais seca: o envio de uma solicitação não garante que a página vá ser exibida no índice. A indexação costuma levar um dia, e pode levar mais. Se a página não for considerada indexável no teste em tempo real, o botão nem envia. Para muitas URLs novas ou atualizadas, a mesma documentação aponta o sitemap, não o clique repetido.
Quando o botão vale a pena
Use o pedido em URL money que você acabou de publicar ou de corrigir, depois de o teste vivo mostrar que ela é indexável. Não use como rotina diária, nem em página que o relatório já classificou como rastreada e recusada.
Como o Google descobre a URL
- Descoberta de URL
- É o processo de o Google ficar sabendo que um endereço existe. Não há um cadastro central de todos os sites. Os três caminhos principais são: o Google já visitou a página antes, extraiu o link de uma página conhecida ou recebeu a lista por sitemap.
Descoberta de URL não depende de um cadastro. A maior parte das páginas listadas na Busca entra porque um rastreador encontrou um rastro, não porque alguém submeteu cada endereço na mão.
| Caminho | Quando ajuda | O que não faz |
|---|---|---|
| Link interno | Navegação clara a partir da home | Página órfã continua invisível |
| Link externo | Marca citada em outros sites | Site novo quase não tem |
| Sitemap | Catálogo grande ou site recém-lançado | Não obriga rastreio nem índice |
| Inspeção de URL | Checagem pontual de uma money page | Não escala e tem cota |
O Googlebot não rastreia tudo o que descobriu. Página atrás de login, regra de robots.txt e servidor instável barram o acesso. Mesmo com acesso, o bot decide quais sites visitar, com que frequência e quantas páginas buscar em cada um, tentando não sobrecarregar o host. Erro HTTP 500 em cadeia é um dos sinais que mandam o rastreador desacelerar.
Site novo, sem menção em lugar nenhum da web, depende de sitemap e de uma navegação interna que o bot consiga percorrer a partir de alguma URL que ele já conheça. Sem um desses dois, o botão de indexação vira a única dica, e uma dica com cota. O trabalho de verdade é deixar rastros que o Google encontre sozinho, o mesmo diagnóstico de causa que uma agência de SEO faz antes de gastar a cota no botão.
Como conferir se está no índice
Três checagens respondem se a URL está no índice, e cada uma mostra um ângulo diferente. A Inspeção fala de uma URL. O operador site: mostra uma amostra pública. O relatório de páginas mostra o volume e os motivos de exclusão. Nenhuma delas é tutorial do Search Console: são ferramentas de conferência.
Inspeção de URL
A Inspeção de URL é o teste daquela página no índice do Google, na propriedade verificada. O relatório inicial não é em tempo real: mostra o que o Google registrou na última visita. "O URL está no Google" quer dizer que há uma versão indexada. Não quer dizer que ela aparece para a busca que você digitou, e a ajuda da ferramenta avisa isso.
Se o status for "O URL não está no Google", abra Disponibilidade. "O rastreamento é permitido?" em Não aponta para robots.txt. "A indexação é permitida?" em Não aponta para noindex. Propriedade errada (www contra apex, HTTP contra HTTPS) gera falso alarme de site sumido. Confira o host da URL canônica antes de sair corrigindo o site inteiro.
Operador site:
O operador site: é a busca pública site:seudominio.com.br. Se voltar zero, a chance de o domínio inteiro estar fora do índice é alta. Se voltar algumas páginas e faltar a money, o problema é daquela URL, não do site. A contagem que o Google mostra nessa busca não é um censo: é uma amostra. Use-a como checagem rápida, não como métrica.
Faça esta busca agora
Digite site:seudominio.com.br no Google. Depois busque a URL money entre aspas. Zero nos dois é problema de índice. A money ausente e o restante presente é problema daquela página.
Relatório de páginas
O relatório de indexação de páginas mostra quantas URLs estão indexadas e, abaixo, os motivos das que não estão. A ajuda está em Relatório de indexação de páginas. A lista de exemplos é limitada a mil itens e não garante que todo URL de um status apareça. Comece pelas money: home, serviços e contato. Página de tag vazia fora do índice não é crise.
Mais páginas não indexadas do que indexadas não é, por si, um erro. Sites com filtros, parâmetros e versões duplicadas geram esse desenho o tempo todo. O que importa é se as URLs que você quer na Busca estão no verde, e se o motivo das outras é o que você espera (cópia, noindex, redirecionamento) ou o que você não espera (bloqueio, descoberta parada, rastreio recusado).
Dois estados de não indexada
Descoberta atualmente não indexada e Rastreada atualmente não indexada são estados diferentes, com remédios diferentes. Tratar os dois com o mesmo clique em Solicitar indexação é o atalho que a SERP brasileira ensina e que a ajuda do Search Console desmente. A interface em português às vezes diz "Detectada" no lugar de "Descoberta": é o mesmo estado.
Descoberta não indexada
Descoberta atualmente não indexada significa que o Google identificou a página e ainda não a rastreou. A ajuda do relatório de páginas diz que, em geral, o Google quis rastrear o URL, mas isso iria sobrecarregar o site, então o rastreamento foi remarcado. Por isso a última data de rastreio fica em branco.
O remédio aqui é de descoberta e de capacidade, não de "pedir de novo". Confira se a URL está no sitemap, se há link interno a partir de uma página já indexada, se o servidor responde 200 com estabilidade e se o robots.txt não está barrando o Googlebot. Site lento, cheio de parâmetros e de cópias ensina o rastreador a adiar. Velocidade de resposta do host, quando ela emperra o crawl, é outro recorte: o bot desacelera diante de erro e de página pesada, e o pedido de indexação não resolve isso.
Rastreada não indexada
Rastreada atualmente não indexada significa que a página foi rastreada e não indexada. A ajuda é explícita: ela pode ou não ser indexada no futuro, e não é necessário reenviar o URL para rastreamento. O Google já viu o conteúdo. Decidiu não guardar agora.
O remédio muda de família. Duplicata pede canonical e consolidação. Qualidade baixa pede texto que responda uma busca de verdade. Página fina, gerada em massa, com o mesmo bloco em cem URLs, raramente ganha segunda chance por clique no Console. Reenviar a URL que o Google já recusou depois de ler é gastar a cota no lugar errado.
Em 30 segundos
Data de rastreio em branco: o bot ainda não veio. Data preenchida e fora do índice: o bot veio e recusou. O primeiro caso pede caminho até a URL. O segundo pede motivo para guardá-la.
Erros clássicos de indexação
Os erros clássicos de indexação impedem a URL de entrar mesmo com o pedido feito. A Inspeção mostra o sintoma. A causa mora no site: noindex, login, 404, canonical apontando para outra, JavaScript que esconde o texto, site novo sem nenhum rastro na web.
noindex e login
noindex é a diretiva certa para página que o humano pode ver e a Busca não deve guardar: thank-you, staging, filtro fino. Login é a trava certa para o que é privado de verdade. Os requisitos técnicos dizem que página que exige log-in não é rastreada. O arquivo robots.txt não é o mecanismo confiável para tirar do Google: URL desallowada ainda pode aparecer se receber links, em geral sem snippet.
O clássico de site "sumido" é um Disallow: / ou um noindex de staging que vazou para produção depois de um plugin, um tema ou um "otimizador". O inverso também existe: staging aberto, sem senha e sem noindex, gerando cópia indexada do site oficial. Abra o código-fonte da money e busque noindex antes de acusar o Google.
404 e soft 404
Erro 404 e os demais códigos de cliente e de servidor não são indexados. A Busca só indexa página com HTTP 200. Soft 404 é a armadilha da aplicação em JavaScript que mostra "não encontrado" com status 200: o Google vê uma página que existe e um conteúdo que diz o contrário. A documentação de JavaScript SEO pede status significativo ou um noindex na página de erro.
Canonical para outra URL
Canonical para outra URL diz ao Google que a página testada não é a versão a guardar. Se a Inspeção mostrar canônica selecionada pelo Google diferente da que você declarou, a sua URL pode ficar de fora de propósito. Parâmetro de campanha, www contra apex e HTTP contra HTTPS produzem esse desenho sem ninguém ter "pedido para não indexar".
JavaScript que esconde
JavaScript que esconde o conteúdo é o modelo de app shell: o HTML inicial vem vazio e o texto só nasce no cliente. O Googlebot enfileira a página para renderizar com Chromium, e isso pode levar segundos ou mais. Conteúdo disparado só depois de um clique, de um fragmento #/rota ou de um componente que não aparece no HTML renderizado não entra no índice. A Inspeção tem a captura e o HTML renderizado: compare com o código-fonte.
Site novo sem links
Site novo sem links é o caso em que ninguém na web aponta para você e a navegação interna ainda não cobre as money. O sitemap passa a ser o principal rastro. O pedido de indexação cobre uma URL por vez, com cota. Sem um desses dois, o Googlebot não tem por onde começar. Não é punição: é descoberta que ainda não aconteceu.
- noindex ou login. A página pede para ficar de fora, ou o bot não entra.
- 404 e soft 404. Não há o que indexar, ou o status mente.
- Canonical alheia. Os sinais foram mandados para outra URL.
- JS vazio no HTML. O texto que você vê no Chrome pode não ser o que o bot guarda.
- Site sem rastro. Ninguém descobriu o endereço ainda.
Sitemap: descobre não obriga
- Sitemap
- É o arquivo em que você lista páginas, vídeos e outros arquivos importantes e a relação entre eles. O Google lê essa lista para rastrear com mais eficiência. Listar uma URL não obriga o Google a rastreá-la nem a indexá-la.
A visão geral em Learn about sitemaps diz quando o arquivo ajuda e quando sobra. Ajuda se o site for grande, novo, com poucos links externos, ou rico em mídia e notícias. Pode não ser necessário se houver cerca de 500 páginas ou menos que importam para a Busca, navegação interna completa a partir da home e pouco conteúdo de vídeo, imagem ou news.
- Só URL canônica. Parâmetro, print e cópia na lista contradizem o que você quer no índice.
- Só o que existe. URL no sitemap e 404 no ar é sinal misturado.
- Sem noindex na lista. Pedir rastreio de página que você mesmo marcou para ficar de fora gasta crawl.
- Envie no Search Console. Acompanhe erro de leitura do arquivo, não o "percentual indexado" como meta de vaidade.
O Google pode ignorar URLs da lista e pode indexar URLs que nunca estiveram nela, se as encontrar por links. Por isso o sitemap precisa estar alinhado à verdade do site: protocolo certo, host certo, só o que você quer ver na Busca. Em CMS, o erro operacional é o arquivo automático incluir rascunho, tag vazia e arquivo de autor. Audite uma amostra antes de achar que "falta sitemap".
O que não adianta no índice
Não se paga para entrar no índice, nem para o Google rastrear mais, nem para ranquear melhor. How Search Works declara isso no começo do documento: se alguém disser o contrário, está errado. Também não há garantia de crawl, índice ou exibição mesmo seguindo as Search Essentials.
- Pagar por "indexação imediata". Não existe produto oficial com esse nome. Quem vende atalho está prometendo uma decisão que não é dele.
- Clicar Solicitar indexação em loop. A documentação de recrawl diz que repetir o mesmo URL não acelera o rastreio, e há cota.
- Diretório milagroso. Cadastro em lista genérica não substitui link real nem sitemap limpo, e conteúdo gerado para manipular a Busca cai nas políticas de spam.
- Redes sociais como atalho de índice. Podem trazer visita. Não são o mecanismo que o Google descreve para descobrir URL.
- Trocar o title e pedir de novo. Se o estado for "Rastreada, não indexada", o bot já leu. O que falta não é outro clique.
O Google não aceita pagamento para rastrear um site com mais frequência nem para ranqueá-lo melhor. Quem diz o contrário está errado.
A tentação do atalho cresce quando o site é novo e a busca site: volta zero. O trabalho honesto nesse ponto é chato e curto: liberar o Googlebot, publicar um sitemap só com URL canônica, ligar as money na navegação e esperar o rastreio, que pode levar dias ou semanas. Encher a cota no primeiro dia não encurta essa fila.
Checklist de indexação
O que dá para conferir sozinho cabe numa tarde, sem ferramenta paga, e para no diagnóstico. Corrigir noindex esquecido, robots.txt e sitemap sujo está nessa faixa. Arquitetura de mil URLs, JavaScript de app e recusa em massa depois do rastreio já não cabem.
-
Busque o domínio
Digite
site:seudominio.com.br. Zero resultado sugere que o índice ainda não tem o site. Algumas páginas presentes e a money ausente apontam para a URL, não para o domínio. - Inspecione a URL money Cole home, serviços e contato na Inspeção. Anote se está no Google, se o rastreio é permitido, se a indexação é permitida e qual canônica o Google escolheu.
- Leia o motivo no relatório Abra o relatório de páginas. Separe Descoberta não indexada de Rastreada não indexada. Não peça recrawl em bloco para os dois.
-
Abra robots.txt e o código-fonte
Confira
/robots.txtcontra umDisallow: /e busquenoindexno HTML da money. Staging que vazou aparece aqui. - Confira o sitemap Veja se a money está na lista, se responde 200 e se a URL é a canônica. Tire rascunho, tag e parâmetro.
- Peça indexação só depois Use o botão na URL já corrigida e indexável no teste vivo. Uma vez. Depois acompanhe. Não gaste a cota em loop.
- Deu certo. A Inspeção passa a dizer que o URL está no Google, e a busca pela URL entre aspas devolve a página.
- Ainda não. O estado mudou para rastreada e recusada, ou a data de rastreio continua em branco depois de semanas: a causa não era o pedido.
- Pare aqui. Volume grande de URLs, app em JavaScript ou recusa em massa depois do crawl pede diagnóstico, não mais um clique.
Quando contratar uma agência
O trabalho de indexação deixa de caber numa tarde quando o site tem centenas de URLs, quando o CMS gera parâmetros e cópias, quando o conteúdo só existe depois do JavaScript, ou quando o relatório mostra recusa em massa depois do rastreio. Aí o clique no Console não escala: cada URL pede causa, e a causa quase nunca é "falta pedir de novo".
Também muda o jogo quando a concorrência já está no índice há anos e a sua loja ou o seu institucional acabou de ir ao ar. Descoberta por link externo não se improvisa. Sitemap e navegação interna resolvem o começo. O restante é arquitetura, conteúdo e medição mês a mês, não um envio único.
O que muda com o volume
Uma URL money com noindex esquecido se resolve na mão. Duzentas URLs com parâmetro, app em JavaScript e recusa depois do rastreio pedem causa por grupo, não um clique por endereço.
É esse o trabalho que a Voh! faz, e só ele: busca orgânica, sem Ads e sem rede social. O canal é um só, e ele vale para qualquer site que precise ser encontrado, do institucional à loja virtual, incluindo a criação do site quando ele ainda não existe. São três formas de começar, uma auditoria gratuita, um pacote de implementação com seis meses de acompanhamento e o SEO Mensal, que não exige fidelidade. O diagnóstico vem sempre antes da proposta, porque orçar sem olhar o site é chute. E não existe garantia de posição: o algoritmo é do Google, e quem promete o contrário está prometendo uma decisão que não é dele. Para a história e o método, leia sobre a Voh!.
Se a Inspeção já mostrou o bloqueio e a correção passa de uma página só, Fale com a Voh!: a análise volta por escrito, com o que encontramos e em que ordem resolveríamos.
Os limites da indexação
Indexar não resolve o que está fora da porta do índice. A URL pode estar no Google e mesmo assim não aparecer para a busca que importa, não gerar clique e não trazer contato. A marca não garante posição, prazo de tráfego, volume de clientes nem ROI.
- Você precisa de cliente esta semana. Índice não é campanha. Orgânico não tem data de chegada. Quem promete o contrário está prometendo o algoritmo.
- A página está no índice e ninguém busca aquilo. O problema passou a ser recorte e conteúdo, não cobertura.
- A URL é duplicata de outra que já ranqueia. Forçar as duas no índice é o oposto do que a canonicalização pede.
- O conteúdo viola política de spam. Página elegível tecnicamente ainda pode ser recusada por qualidade ou por manipulação.
- Você quer Ads ou gestão de rede. Isso está fora do canal. Indexação é busca orgânica, e só ela.
Há casos em que a resposta honesta é não indexar. Thank-you, área logada, filtro de catálogo e staging não deveriam competir com a money na Busca. O trabalho certo aí é noindex ou senha, não o botão de solicitar.
Resumo em 10 pontos
- Indexar o site no Google é colocar a URL no índice da Busca, não conquistar posição.
- A Busca tem três estágios: rastreio, indexação e exibição. Nem toda URL completa os três.
- A maior parte das páginas entra porque o Google encontrou um link ou um sitemap, não porque alguém submeteu cada URL.
- O pedido de indexação é uma dica com cota. Não garante índice e repetir o mesmo endereço não acelera.
- Três checagens: Inspeção de URL,
site:e relatório de páginas. - Descoberta não indexada e Rastreada não indexada pedem remédios diferentes. Não trate as duas com o mesmo clique.
- robots.txt controla rastreio, não tira do índice com confiança. noindex ou login são o caminho para ocultar.
- Sitemap ajuda a descobrir. Não obriga a indexar.
- Não se paga para o Google rastrear mais ou ranquear melhor. Diretório milagroso e loop no botão não substituem o trabalho.
- O que cabe sozinho é conferir e destravar bloqueio óbvio. Volume, JS e recusa em massa pedem diagnóstico.
Se quiser saber o que especificamente está travando o seu site no índice, Fale com a Voh!: a análise volta por escrito, sem custo e em até 48h.