Site não aparece no ChatGPT é, quase sempre, um problema de acesso: o crawler foi barrado antes de ler a primeira linha do seu conteúdo.
Não é penalidade. Não é falta de autoridade. É um 403 devolvido por um plugin que alguém instalou para proteger o login.
E nada disso aparece no seu relatório de SEO.
Você publica com frequência, tem domínio antigo, ranqueia bem no Google. Aí pergunta ao ChatGPT sobre o seu tema e ele cita o concorrente que publica metade do que você publica.
Na maioria dos diagnósticos que fazemos, o motivo está na infraestrutura, não na pauta.
Acesso é a camada 1 do GEO técnico

Antes de estrutura semântica, dados estruturados ou clareza de resposta, existe uma pergunta binária: o bot consegue entrar e receber um HTTP 200?
Se a resposta é não, todo o resto é irrelevante. É o que chamamos de camada de acesso dentro do nosso framework GEO técnico de 6 camadas.
Pense na portaria de um prédio comercial. Você pode ter o melhor escritório do andar 12, com a melhor proposta impressa em cima da mesa. Se o porteiro barra o visitante no térreo, a proposta nunca é lida.
Seu WordPress tem uma portaria. E ela costuma estar mais rígida do que você imagina.
Os bots que importam e o que cada um faz
Bloquear tudo que tem “AI” no nome é a decisão mais cara que um time de marketing toma sem perceber. Treino e citação são coisas diferentes, e a gente já detalhou isso em bot de treino vs bot de citação.
User-agent | Função | Efeito do bloqueio |
|---|---|---|
GPTBot | Coleta conteúdo para treinamento de modelos da OpenAI | Sua marca fica fora da base de conhecimento do modelo |
OAI-SearchBot | Indexa páginas para a busca do ChatGPT | Você deixa de ser candidato a citação nas respostas |
ChatGPT-User | Acessa a URL ao vivo quando o usuário pede | O link não abre dentro da conversa |
PerplexityBot | Indexa páginas para respostas da Perplexity | Ausência nas citações com fonte |
Google-Extended | Controla uso do conteúdo em produtos Gemini | Sem impacto no ranqueamento, impacto em IA |
Os nomes oficiais e as faixas de IP estão na documentação de bots da OpenAI. Vale conferir antes de escrever qualquer regra.
O robots.txt que o seu plugin de SEO reescreveu
O WordPress serve um robots.txt virtual. Yoast, Rank Math e boa parte dos plugins de SEO sobrescrevem esse arquivo.
Três padrões que encontramos com frequência:
Um Disallow para GPTBot copiado de tutorial de 2023, quando a discussão pública era só sobre treinamento e ninguém falava de citação em resposta.
Regras de agência antiga que bloqueiam diretórios inteiros (/wp-content/uploads/, por exemplo) e derrubam imagens e PDFs que sustentam o conteúdo.
A caixinha “Pedir aos mecanismos de busca que não indexem este site” ativa em Configurações, Leitura, herdada do ambiente de homologação. Ela injeta Disallow em tudo, como descreve a documentação do WordPress.
Essa última é a mais comum em site que migrou de staging para produção às pressas.
Plugins de segurança: o vilão silencioso
Aqui mora o caso clássico de site não aparece no ChatGPT mesmo com robots.txt limpo.
Wordfence, Solid Security e All In One WP Security têm regras de rate limiting e bloqueio por user-agent. A configuração padrão de “bloquear crawlers agressivos” trata GPTBot exatamente como trata um scraper de conteúdo.
Resultado: 403 na portaria, sem log que o time de marketing consiga ler.
Na camada de borda o cenário se repete. O Cloudflare oferece bloqueio de crawlers de IA em um clique, anunciado no próprio blog da empresa. Alguém do time de TI ativa isso por precaução e ninguém avisa o marketing.
Bot Fight Mode, desafio de JavaScript e ModSecurity produzem o mesmo efeito. O bot recebe um challenge, não resolve, vai embora.
Tem ainda o bloqueio geográfico. Muita operação brasileira restringe acesso fora do Brasil para reduzir ataque de força bruta. Crawlers de IA rodam majoritariamente em datacenters nos Estados Unidos.
Você não bloqueou a IA. Você bloqueou o país dela.
Configs de WordPress que passam despercebidas
Além do firewall, quatro pontos que revisamos em toda auditoria:
Plugin de manutenção ou coming soon ativo em parte do site, devolvendo 503 para quem não está logado, inclusive para os crawlers.
Conteúdo atrás de login ou paywall: se o valor está no gated, a IA lê a chamada e ignora a substância.
Renderização dependente de JavaScript: crawlers de IA, em geral, não executam JS como o Googlebot. Conteúdo carregado por fetch depois do load simplesmente não existe para eles.
Cache servindo a página errada: uma resposta de challenge cacheada por CDN é entregue ao bot em milissegundos, com status de bloqueio.
Particularmente, eu começaria pelo terceiro item em sites feitos com page builder pesado. É onde o estrago costuma ser maior e menos visível.
Como testar se o problema é bloqueio
Diagnóstico de site não aparece no ChatGPT começa com curl, não com achismo.
Faça uma requisição com o user-agent GPTBot e outra com OAI-SearchBot para uma URL de conteúdo relevante. O que interessa é o status code: 200 passa, 403 e 503 não.
Abra seudominio.com.br/robots.txt no navegador e leia linha por linha, procurando Disallow por user-agent específico.
Busque os user-agents de IA nos logs de acesso do servidor dos últimos 30 dias. Zero registro é diagnóstico, não coincidência.
Revise as regras de firewall na borda (Cloudflare ou WAF) e no plugin de segurança, com o time de TI na mesma call.
Compare o HTML bruto (view-source) com o que aparece na tela. A diferença é o que a IA não lê.
Detalhamos a mecânica de coleta em crawlers de IA: como acessam seu site WordPress.
Perguntas frequentes sobre site não aparece no ChatGPT
Liberar GPTBot prejudica meu SEO no Google?
Não. GPTBot e Google-Extended são controles independentes do Googlebot. Liberar crawlers de IA não altera ranqueamento orgânico, porque o robots.txt trata cada user-agent de forma isolada.
Quanto tempo leva para aparecer depois de desbloquear?
Não existe prazo garantido. Índices de busca com IA atualizam em ciclos próprios, e a base de treinamento tem recortes temporais. Desbloqueio hoje não vira citação amanhã.
Bloquear IA protege meu conteúdo de cópia?
Bloquear o bot de treino é uma decisão legítima de negócio. Bloquear o bot de citação é abrir mão de tráfego e de menção de marca. São escolhas separadas e devem ser tratadas assim.
Conclusão
Se o seu site não aparece no ChatGPT, a hipótese mais provável não é qualidade de conteúdo. É uma regra de acesso escrita por outra pessoa, em outro contexto, para resolver outro problema.
Verificamos. Testamos. Ajustamos a regra. Depois discutimos semântica.
Aqui na Apiki, esse levantamento de camada de acesso é o primeiro passo do nosso Diagnóstico GEO Técnico, e ele costuma explicar boa parte da invisibilidade em respostas de IA. Se quiser seguir sozinho, comece pelo nosso checklist de visibilidade para IA no WordPress.
Me conta: você já olhou os logs do seu servidor procurando GPTBot?