Busca com Inteligência Artificial
Como aparecer no ChatGPT: o que funciona de verdade
O ChatGPT cita um site quando o OAI-SearchBot consegue rastreá-lo e o conteúdo responde à pergunta com clareza. Não existe arquivo mágico nem painel de ranking: o requisito é o mesmo de sempre, ser encontrado, lido e considerado uma fonte confiável.
Ser citado pelo ChatGPT
Aparecer no ChatGPT virou pergunta comum de quem já cuida do site no Google, e o mercado brasileiro respondeu com uma enxurrada de conteúdo vendendo plugin, arquivo especial e ferramenta de "GEO tools" prometendo medir citação em tempo real. Uma checagem na busca por "como aparecer no chatgpt" mostra artigo atrás de artigo com lista numerada de hacks, quase nenhum citando a documentação oficial da OpenAI ou do Google sobre o assunto.
Este guia é o recorte específico do ChatGPT dentro de um assunto maior, o que é geo, e assume que a diferença entre busca generativa e SEO de sempre já ficou resolvida ali. Aqui a pergunta é mais estreita: o que dá para conferir, de verdade, sobre o ChatGPT em particular, com fonte primária para cada afirmação.
A resposta curta já desmonta boa parte da oferta comercial em cima do tema: não existe arquivo, plugin ou marcação que force uma citação, e nenhuma agência de SEO séria promete isso, porque a decisão de citar ou não é do sistema da OpenAI, não de quem publica o conteúdo.
Antes de continuar
Este guia é sobre o ChatGPT especificamente, não sobre as Visões Gerais do Google, que têm mecanismo próprio e já foram detalhadas no capítulo sobre AI Overviews e AI Mode do guia de GEO e AEO citado acima. As duas coisas se parecem por fora, mas rodam sobre sistemas diferentes, com crawler, política e janela de atualização próprias.
A pergunta "como aparecer no ChatGPT" na verdade esconde duas perguntas diferentes. Uma é técnica: o que precisa estar liberado para o rastreador conseguir ler o site. A outra é editorial: o que faz um texto valer a pena ser usado como resposta. A maior parte do conteúdo em português resolve só a segunda, com conselho genérico do tipo "escreva bom conteúdo", sem nunca abrir o manual técnico que explica quem, de fato, decide.
ChatGPT Search: como funciona
- ChatGPT Search
- ChatGPT Search é o recurso que permite ao ChatGPT buscar informação atual na web e responder com links clicáveis para as fontes usadas, disponível para todos os planos, inclusive para quem usa o produto sem estar logado.
Ao receber uma pergunta que se beneficia de informação da web, o ChatGPT reescreve essa pergunta em uma ou mais buscas mais específicas e as envia a provedores de busca parceiros, revisando os resultados antes de montar a resposta, segundo a central de ajuda da OpenAI. Uma pergunta sobre restaurante perto do usuário, por exemplo, pode virar a busca "melhores restaurantes em São Paulo" depois que o sistema estima a localização pelo endereço IP, sem compartilhar esse endereço com o parceiro de busca.
Quando a busca é usada, o ChatGPT costuma mostrar citação em linha ou um painel de "Fontes" abaixo da resposta, com o logotipo de cada site citado. É esse painel que qualquer empresa quer preencher, e ele só existe quando a busca de fato aconteceu: pergunta respondida só com o que o modelo já sabia, sem consultar a web, não gera citação nenhuma.
O painel de fontes
O painel de "Fontes" é o equivalente mais próximo de uma posição de ranking dentro do ChatGPT, mesmo sem existir um número de posição visível. A própria central de ajuda descreve o botão "Sources" abrindo um painel com o logotipo de cada publicador citado, um formato mais parecido com uma lista de referências do que com os dez links azuis de uma busca tradicional.
Na prática, isso muda o que vale a pena otimizar: não adianta tentar vencer uma disputa de posição, porque não existe uma posição única para vencer. O que existe é um conjunto de fontes usadas naquela resposta específica, e um site pode aparecer nesse conjunto junto de dois ou três concorrentes, sem exclusividade nenhuma.
Treinamento e busca ao vivo
O ChatGPT usa dois rastreadores diferentes para dois trabalhos diferentes, e confundir os dois é o erro mais comum de quem tenta "aparecer na IA" sem checar a fonte primária. A documentação de crawlers publicada pela própria OpenAI separa os dois com clareza.
- GPTBot
- GPTBot é o rastreador que a OpenAI usa para coletar conteúdo público que pode entrar no treinamento dos modelos de linguagem, o material que forma o conhecimento de fábrica do ChatGPT, fixado numa data de corte que não se atualiza sozinha.
OAI-SearchBot é outro rastreador, independente do GPTBot, e é ele que decide se um site pode ser mostrado nas respostas de busca do ChatGPT. Um site pode bloquear o GPTBot e liberar o OAI-SearchBot, ou o contrário, porque, segundo a documentação de crawlers da OpenAI, "cada configuração é independente das outras".
| Rastreador | Para que serve | Se eu bloquear |
|---|---|---|
| GPTBot | Coleta conteúdo para treinar os modelos de linguagem | O conteúdo não entra no próximo treinamento, sem afetar a busca |
| OAI-SearchBot | Decide o que pode ser citado na busca do ChatGPT | O site some das respostas de busca, mesmo indexado no Google |
| ChatGPT-User | Visita uma página quando o próprio usuário pede uma ação pontual | Não é usado para rastreamento automático nem decide citação |
Vale notar que a regra do GPTBot vale para rastreamentos futuros: bloquear esse robô hoje não remove dado já usado em versão anterior do modelo, é apenas o pedido para não incluir mais o site dali para frente. Isso não afeta a busca em nada, porque o OAI-SearchBot segue a própria regra, independente do que acontece com o GPTBot.
A data do treinamento engana
O conhecimento de treinamento do ChatGPT tem uma data de corte fixa, e perguntar sobre algo lançado depois dela sem usar a busca devolve uma resposta desatualizada ou genérica. É por isso que um site novo, uma mudança de nome ou um lançamento recente só aparecem de forma confiável quando o ChatGPT busca ao vivo, nunca quando responde só do que já sabia.
O requisito técnico é só um
O requisito técnico para ser citado é o mesmo nos dois maiores sistemas de resposta com IA: o Google exige página indexada e elegível a snippet, e a OpenAI exige que o OAI-SearchBot consiga rastrear o site. Nenhum dos dois pede marcação especial, e os dois documentam isso por escrito.
- Elegibilidade a snippet
- Elegibilidade a snippet é a condição, definida pelo Google, de uma página estar indexada e livre de bloqueios que a impeçam de mostrar um resumo de texto nos resultados, o mesmo requisito citado para aparecer nas Visões Gerais Criadas por IA e no Modo IA, segundo o guia de otimização para IA generativa do Google.
A própria central de ajuda da OpenAI é direta sobre a ausência de garantia, em tradução livre do texto original em inglês:
"A classificação na busca do ChatGPT é baseada em vários fatores criados para ajudar os usuários a encontrar informação confiável e relevante. Não existe uma forma de garantir a primeira posição."
A frase seguinte, na mesma página, é a parte prática: para ser incluído, é importante permitir que o OAI-SearchBot rastreie o site e liberar tráfego vindo dos endereços IP publicados pela OpenAI.
Duas frases, um pedido só
O Google fala em "indexado e elegível a snippet". A OpenAI fala em "permitir o OAI-SearchBot e os IPs publicados". São frases diferentes para o mesmo pedido: deixe o robô entrar, e dê a ele algo que valha a pena mostrar.
Onde medir o resultado
O lado do Google já tem número público, pelo relatório de desempenho em recursos de IA generativa do Search Console, capítulo já detalhado no guia de GEO e AEO citado no início deste texto. O lado do ChatGPT não tem um relatório equivalente: a única forma de checar hoje é perguntar diretamente, com a busca ativada, e observar o painel de fontes.
OAI-SearchBot: como liberar o site
Liberar o OAI-SearchBot é a única ação técnica exclusiva de ChatGPT que este guia recomenda, e ela leva menos de cinco minutos para quem já editou um robots.txt alguma vez.
User-agent: OAI-SearchBot
Allow: /
User-agent: GPTBot
Allow: /
Publicar essas duas linhas em seudominio.com.br/robots.txt libera os dois rastreadores. Quem quer aparecer na busca do ChatGPT mas não quer que o conteúdo entre em treinamento de modelo pode manter o OAI-SearchBot liberado e trocar o GPTBot para Disallow: /, porque as duas regras não dependem uma da outra.
Robots.txt não é o único bloqueio
Alguns provedores de hospedagem e redes de proteção contra bots barram tráfego por endereço IP, mesmo com o robots.txt liberado. A OpenAI publica os intervalos de IP usados pelo OAI-SearchBot para esse tipo de checagem, e confirmar isso junto de quem administra o servidor evita um bloqueio invisível.
Quem usa uma rede de proteção contra bots, comum em sites com CDN, também vale conferir se existe alguma regra do tipo "bloquear bots de IA" ativada por padrão. Esse tipo de proteção às vezes já vem ligado antes de qualquer configuração manual em robots.txt, e barra o rastreador num nível que o próprio dono do site nem sempre enxerga sem procurar.
O mito do arquivo mágico
Nenhum arquivo substitui rastreamento liberado e conteúdo bom, e a documentação de otimização para IA generativa do Google lista isso nominalmente entre os mitos do assunto, na mesma página já citada acima: não é preciso criar arquivo llms.txt, fatiar o conteúdo em pedaços pequenos, reescrever o texto num "estilo para IA" nem empilhar dados estruturados que o site não usava antes.
- Arquivo llms.txt. Não consta como requisito nem na documentação do Google nem na documentação de crawlers da OpenAI. Nenhum dos dois sistemas depende dele para decidir o que citar.
- Fatiar o conteúdo em pedaços minúsculos. Os dois sistemas conseguem entender contexto de uma página inteira, sem exigir fragmentação artificial.
- Reescrever tudo num "tom de IA". Sistemas de busca com IA entendem sinônimo e intenção, sem precisar da pergunta repetida palavra por palavra.
- Ferramenta de "monitoramento de GEO" com número exato de citações. Não existe hoje um painel público, nem da OpenAI nem de terceiro confiável, que meça isso com precisão para todas as plataformas de IA ao mesmo tempo.
O risco de exagerar
Criar uma página para cada variação de pergunta que o ChatGPT poderia fazer é abuso de conteúdo em escala, segundo as políticas de spam do Google, que valem tanto para a busca tradicional quanto para os recursos de IA generativa. Volume de página não aumenta relevância, e pode derrubar a que já existia.
Sinais de que o ChatGPT não te vê
Cinco sintomas costumam aparecer juntos quando um site está fora do alcance do ChatGPT, e nenhum deles exige ferramenta paga para ser conferido.
- O site não aparece nem em
site:seudominio.com.brno Google. Se o Google nunca indexou, o ChatGPT também não tem de onde puxar a página. - O robots.txt tem um
Disallow: /genérico herdado de um site em desenvolvimento. Isso bloqueia todo crawler, inclusive o OAI-SearchBot. - O conteúdo relevante mora só em imagem, vídeo ou PDF escaneado. Nenhum dos dois sistemas lê texto que não existe como texto na página.
- Perguntar pelo nome da própria empresa no ChatGPT devolve uma resposta genérica ou "não tenho informação sobre isso". É sinal de que a marca não tem presença suficiente em nenhuma fonte que o sistema use.
- A resposta cita concorrentes diretos pelo nome, mas nunca a própria empresa, mesmo numa pergunta que compara opções do mesmo setor. Costuma indicar que o conteúdo do concorrente responde à pergunta com mais clareza, não necessariamente que ele seja maior ou mais antigo.
Checklist para aparecer no ChatGPT
Os cinco passos abaixo cobrem o que dá para conferir e ajustar sem depender de ninguém, todos seguindo o mesmo requisito técnico já explicado: rastreamento liberado e conteúdo em texto que responda direto.
-
Confira o robots.txt
Acesse
seudominio.com.br/robots.txte procure por "OAI-SearchBot" ou por umDisallow: /genérico logo no topo do arquivo. Sem bloqueio explícito, o crawler já está livre. -
Teste a indexação no Google
Busque
site:seudominio.com.br. Página fora desse resultado dificilmente é achada por qualquer sistema, incluindo o ChatGPT. - Pergunte ao próprio ChatGPT Abra uma conversa nova, ative a busca e pergunte pelo nome da empresa e pelo que ela faz. Veja se o painel de fontes cita o próprio site ou só menções de terceiros.
- Releia o primeiro parágrafo da página mais importante Confira se ele responde à pergunta central em duas ou três frases, sem depender do parágrafo anterior para fazer sentido.
- Confirme que o conteúdo central está em texto Abra "Exibir código-fonte" e veja se o texto que aparece na tela também aparece ali, e não só dentro de uma imagem ou de um script que carrega depois.
- Robots.txt sem bloqueio ao OAI-SearchBot. Nenhuma diretriz genérica está barrando o rastreador por engano.
- Site indexado no Google. O comando
site:devolve pelo menos a página inicial. - Nome da empresa gera resposta reconhecível. Perguntar no ChatGPT com busca ativada traz alguma informação correta, não um "não sei".
- Conteúdo principal em texto lido. A informação que importa não está presa dentro de uma imagem.
Em 30 segundos
Robots.txt liberado para o OAI-SearchBot, site indexado no Google e conteúdo em texto que responde direto são os três pontos que cobrem quase todo o requisito técnico documentado até aqui. O resto é a mesma qualidade de conteúdo que já valia antes do ChatGPT existir.
Quando aparecer no ChatGPT vira projeto
Uma checagem pontual resolve o básico, mas um catálogo de centenas de produtos, um blog com anos de conteúdo raso ou um concorrente que já virou referência de citação não se resolvem numa tarde de ajuste em robots.txt. Catálogo grande, páginas herdadas de plataformas antigas e conteúdo acumulado ao longo de anos sem revisão formam o perfil mais comum de quem procura ajuda especificamente por causa do ChatGPT: o pedido chega específico, mas o diagnóstico quase sempre volta para arquitetura do site e qualidade do conteúdo, que é onde o trabalho de verdade acontece.
É esse o trabalho que a Voh! faz, e só ele: busca orgânica, sem Ads e sem rede social. O canal é um só, e ele vale para qualquer site que precise ser encontrado, do institucional à loja virtual, incluindo a criação do site quando ele ainda não existe. São três formas de começar, uma auditoria gratuita, um pacote de implementação com seis meses de acompanhamento e o SEO Mensal, que não exige fidelidade. O que entra em cada frente está descrito nos serviços de SEO. O diagnóstico vem sempre antes da proposta, porque orçar sem olhar o site é chute. E não existe garantia de posição nem de citação por IA: o algoritmo é do Google, o critério de busca é da OpenAI, e quem promete o contrário está prometendo uma decisão que não é dele. Para a história e o método, leia sobre a Voh!.
Uma auditoria nesse formato costuma cobrir rastreamento e indexação, arquitetura de conteúdo, qualidade e originalidade do texto existente e sinais de confiança como dados de negócio corretos. Nenhuma dessas frentes muda porque o objetivo declarado é "aparecer no ChatGPT": é a mesma auditoria que já resolvia o problema antes desse nome estar na conversa, só que agora relatada também sob a ótica de rastreamento por um segundo sistema. Se o volume de páginas já passou do que dá para conferir sozinho, Fale com a Voh!: a análise volta por escrito, sem custo e em até 48h.
61 cliques e 8.449 impressões
Desentupidora Geraltec, Ribeirão Preto, em 30 dias
Google Search Console. Resultado de trabalho de SEO geral daquele projeto, não uma medida de citação em ChatGPT, e não é previsão para outro site.
Os limites de aparecer no ChatGPT
Nem toda empresa deveria colocar essa pergunta no topo da lista, e forçar a pauta no ChatGPT quando o problema é outro custa tempo sem entregar nada.
- O site nunca foi indexado no Google. Resolver isso é SEO técnico, e vem antes de qualquer discussão específica sobre ChatGPT.
- A meta é garantir citação em toda pergunta relacionada. Ninguém garante isso: nem o Google garante Visão Geral, nem a OpenAI garante posição no painel de fontes.
- A empresa precisa de resultado numa campanha de lançamento desta semana. Citação por IA é cumulativa, como o SEO tradicional; quem precisa de demanda imediata depende de outro canal, como mídia paga.
- Não existe conteúdo original nenhum para estruturar. Nenhum ajuste técnico de robots.txt transforma texto raso em fonte citável.
- A meta é só o ChatGPT, ignorando o resto da busca. A maior parte do tráfego orgânico ainda vem do Google, e otimizar só para um sistema de IA de terceiro deixa a base inteira mais fraca.
- A empresa mudou de nome ou de domínio recentemente. O conhecimento de treinamento do modelo pode ainda citar o nome antigo, e só a busca ao vivo, quando ativada pelo usuário, tem chance real de mostrar a informação atualizada.
"Muito conteúdo prospera na Busca do Google, incluindo em experiências de IA generativa, sem nenhuma otimização explícita para IA. Você não precisa realizar tudo o que está neste guia para ter sucesso."
Resumo em 7 pontos
- O ChatGPT tem dois rastreadores diferentes: GPTBot coleta para treinar modelos, e OAI-SearchBot decide o que aparece citado na busca.
- O requisito técnico é o mesmo dos dois lados: página indexada e elegível a snippet para o Google, rastreamento liberado ao OAI-SearchBot para a OpenAI.
- Não existe garantia de posição, e a própria central de ajuda da OpenAI afirma isso por escrito.
- Liberar o site leva minutos: duas linhas no robots.txt, mais a checagem de bloqueio por IP com quem administra o servidor.
- Arquivo llms.txt, fatiar conteúdo e "tom de IA" não são requisito em nenhuma das duas documentações oficiais consultadas.
- Cinco sinais ajudam a diagnosticar um site fora do radar: sem indexação, robots.txt bloqueando, conteúdo só em imagem, resposta genérica ao nome da empresa e concorrente citado no lugar dela.
- Site com histórico grande de páginas costuma exigir auditoria contínua, não apenas o ajuste técnico pontual deste guia.
Se quiser saber o que especificamente está travando a visibilidade do seu site, na busca clássica ou nas respostas de IA, Fale com a Voh!: a análise volta por escrito. Para entender como IA generativa se encaixa no resto do marketing digital, o guia sobre inteligência artificial no marketing digital é o próximo passo deste blog.