Ferramenta gratuita

Gerador de robots.txt para IA

Escolha o que liberar ou bloquear para cada crawler de IA — GPTBot, ClaudeBot, PerplexityBot e mais 10 tokens — e copie um robots.txt pronto, com a diretiva Content-Signal incluída. Tudo roda no seu navegador, sem cadastro. Na rodada 1 do nosso Índice de Prontidão para IA (agosto de 2026), só 6 de 18 domínios brasileiros de SEO/GEO declaravam explicitamente algum rastreador de IA no robots.txt — esta página existe para fechar essa lacuna em cinco minutos.

Para entender cada decisão em profundidade, leia o guia completo de robots.txt para GPTBot e crawlers de IA.

Comece por um perfil:
Busca dentro das IAs

Indexam páginas para a busca em tempo real de cada assistente. Bloquear estes bots tira sua marca das respostas com fontes citadas — para GEO, a recomendação é permitir.

Acesso disparado pelo usuário

Entram em ação quando uma pessoa pede ao assistente para abrir uma URL específica. Bloquear torna seu site inacessível em consultas que mencionam sua marca.

Treinamento de modelos

Coletam conteúdo para treinar modelos futuros. É a decisão estratégica do arquivo: editores com paywall costumam bloquear; negócios B2B que querem virar fonte citada costumam permitir.

Tokens de permissão (não são crawlers)

Não rastreiam nada: sinalizam ao crawler principal da empresa se o conteúdo já coletado pode ser usado em IA generativa. Bloquear não afeta seu ranking na busca tradicional.

Content-Signal

Declara em uma linha o uso permitido do conteúdo, conforme a Content Signals Policy. Os valores abaixo se ajustam sozinhos aos perfis, mas podem ser editados.

Seu robots.txt
            

Troque www.seusite.com.br pelo seu domínio na linha Sitemap. Se o seu site já tem um robots.txt, mescle os blocos com as regras existentes em vez de substituir o arquivo.

Perguntas frequentes sobre robots.txt e crawlers de IA

O gerador de robots.txt para IA é gratuito?

Sim — gratuito, sem cadastro e sem coleta de dados. A ferramenta roda inteiramente no seu navegador: nenhuma escolha sua é enviada a servidor algum. Copie o resultado e cole na raiz do seu domínio.

Bloquear o GPTBot me tira do Google?

Não. O GPTBot é o crawler de treinamento da OpenAI e não tem relação com o Googlebot. Bloqueá-lo também não tira você da busca do ChatGPT — quem indexa para essa busca é o OAI-SearchBot, um bot separado com regra própria.

Qual a diferença entre GPTBot e OAI-SearchBot?

GPTBot coleta conteúdo para treinar modelos futuros da OpenAI; OAI-SearchBot indexa páginas para a busca em tempo real dentro do ChatGPT. São bots distintos e independentes: dá para bloquear o treinamento e continuar aparecendo (com link citado) nas respostas de busca.

O que é a linha Content-Signal?

É uma diretiva proposta pela Content Signals Policy (contentsignals.org) que declara, em uma linha, se o conteúdo pode ser usado em busca (search), como insumo de respostas de IA (ai-input) e em treinamento (ai-train). Complementa — não substitui — as regras por User-agent.

O robots.txt garante que as IAs não usem meu conteúdo?

Não garante. O robots.txt é uma diretiva voluntária (RFC 9309): crawlers de empresas estabelecidas como OpenAI, Anthropic, Google e Perplexity declaram respeitá-lo, mas nada impede tecnicamente um bot mal-comportado de ignorá-lo. Para bloqueio rígido, o caminho é firewall/WAF.

Onde coloco o arquivo gerado?

Na raiz pública do seu domínio, acessível em https://seudominio/robots.txt. Se já existe um robots.txt, mescle os blocos gerados com as regras atuais em vez de substituir o arquivo inteiro — e teste o resultado antes de publicar.

Quer ir além do arquivo? O framework de decisão por crawler e o guia de llms.txt — o outro arquivo que as IAs leem completam a camada técnica de acesso.

O robots.txt é a porta. O conteúdo é o convite.

Liberar os crawlers certos é o primeiro passo; virar fonte citada nas respostas exige conteúdo e autoridade. O diagnóstico gratuito mostra como sua marca aparece hoje no ChatGPT, Gemini e Perplexity.