Gerador de robots.txt para IA
Escolha o que liberar ou bloquear para cada crawler de IA — GPTBot, ClaudeBot, PerplexityBot e mais 10 tokens — e copie um robots.txt pronto, com a diretiva Content-Signal incluída. Tudo roda no seu navegador, sem cadastro. Na rodada 1 do nosso Índice de Prontidão para IA (agosto de 2026), só 6 de 18 domínios brasileiros de SEO/GEO declaravam explicitamente algum rastreador de IA no robots.txt — esta página existe para fechar essa lacuna em cinco minutos.
Para entender cada decisão em profundidade, leia o guia completo de robots.txt para GPTBot e crawlers de IA.
Troque www.seusite.com.br pelo seu domínio na linha Sitemap. Se o seu site já tem um robots.txt, mescle os blocos com as regras existentes em vez de substituir o arquivo.
Perguntas frequentes sobre robots.txt e crawlers de IA
O gerador de robots.txt para IA é gratuito?
Sim — gratuito, sem cadastro e sem coleta de dados. A ferramenta roda inteiramente no seu navegador: nenhuma escolha sua é enviada a servidor algum. Copie o resultado e cole na raiz do seu domínio.
Bloquear o GPTBot me tira do Google?
Não. O GPTBot é o crawler de treinamento da OpenAI e não tem relação com o Googlebot. Bloqueá-lo também não tira você da busca do ChatGPT — quem indexa para essa busca é o OAI-SearchBot, um bot separado com regra própria.
Qual a diferença entre GPTBot e OAI-SearchBot?
GPTBot coleta conteúdo para treinar modelos futuros da OpenAI; OAI-SearchBot indexa páginas para a busca em tempo real dentro do ChatGPT. São bots distintos e independentes: dá para bloquear o treinamento e continuar aparecendo (com link citado) nas respostas de busca.
O que é a linha Content-Signal?
É uma diretiva proposta pela Content Signals Policy (contentsignals.org) que declara, em uma linha, se o conteúdo pode ser usado em busca (search), como insumo de respostas de IA (ai-input) e em treinamento (ai-train). Complementa — não substitui — as regras por User-agent.
O robots.txt garante que as IAs não usem meu conteúdo?
Não garante. O robots.txt é uma diretiva voluntária (RFC 9309): crawlers de empresas estabelecidas como OpenAI, Anthropic, Google e Perplexity declaram respeitá-lo, mas nada impede tecnicamente um bot mal-comportado de ignorá-lo. Para bloqueio rígido, o caminho é firewall/WAF.
Onde coloco o arquivo gerado?
Na raiz pública do seu domínio, acessível em https://seudominio/robots.txt. Se já existe um robots.txt, mescle os blocos gerados com as regras atuais em vez de substituir o arquivo inteiro — e teste o resultado antes de publicar.
Quer ir além do arquivo? O framework de decisão por crawler e o guia de llms.txt — o outro arquivo que as IAs leem completam a camada técnica de acesso.
O robots.txt é a porta. O conteúdo é o convite.
Liberar os crawlers certos é o primeiro passo; virar fonte citada nas respostas exige conteúdo e autoridade. O diagnóstico gratuito mostra como sua marca aparece hoje no ChatGPT, Gemini e Perplexity.