Ferramentas

Gerador de robots.txt

Crie um arquivo robots.txt limpo e válido para o seu site. Defina regras de rastreamento, adicione sitemaps e copie o resultado para a raiz do site.

Carregar existente

Importado com avisos

Sitemaps

Adicione uma ou mais URLs de sitemap. Elas são escritas no final do arquivo robots.txt.

O Yandex usa isso para identificar seu domínio preferido. Deixe em branco se não precisar.

Resultado do robots.txt

User-agent: *
Allow: /

Sitemap: https://example.com/sitemap.xml

Salve o resultado como robots.txt na raiz do site (por exemplo, https://example.com/robots.txt).

Envie para o servidor ou adicione pelo gerenciador de arquivos da hospedagem ou do CMS. Os rastreadores podem demorar para notar as mudanças.

Crie um robots.txt em minutos

Um arquivo robots.txt diz aos rastreadores quais áreas do site eles podem e não podem rastrear. É uma das formas mais simples de orientar o acesso dos mecanismos de busca e costuma evitar o rastreamento de páginas, pastas ou arquivos desnecessários.

O gerador de robots.txt ajuda a criar um arquivo válido sem decorar a sintaxe. Adicione regras de rastreamento, grupos de user-agent e URLs de sitemap, e copie o arquivo pronto para o site.

Allow e Disallow

As duas diretivas mais comuns do robots.txt são Allow e Disallow. Disallow pede aos rastreadores que não solicitem as URLs correspondentes, e Allow cria exceções dentro de trechos bloqueados mais amplos.

Na maioria dos sites, um grupo User-agent: * é suficiente. Crie grupos extras só quando rastreadores específicos, como Googlebot ou Bingbot, precisarem de regras diferentes.

Ajude os mecanismos de busca a encontrar seus sitemaps

Adicionar uma ou mais diretivas Sitemap ajuda os mecanismos de busca a encontrar seus sitemaps XML. Isso é especialmente útil em sites grandes ou que publicam sitemaps separados para páginas, imagens, vídeos, notícias ou outros tipos de conteúdo. Depois de adicionar a URL de um sitemap, use o validador de sitemap para confirmar que o arquivo é válido e pode ser alcançado.

O que este gerador oferece

  • Crie arquivos robots.txt com vários grupos de user-agent e regras de rastreamento.
  • Veja o arquivo atualizar na hora enquanto você edita.
  • Copie o robots.txt pronto com um clique.
  • Valide caminhos, URLs de sitemap e valores de crawl-delay.
  • Importe um robots.txt existente de uma URL, de um rascunho salvo ou de texto colado.
  • Salve rascunhos no navegador.
  • Adicione uma ou mais URLs de sitemap e uma diretiva Host opcional.

Quando usar robots.txt?

Use robots.txt quando quiser orientar como os rastreadores acessam o site. É comum bloquear áreas de admin, buscas internas, conteúdo temporário, ambientes de desenvolvimento ou outras seções que não precisam ser rastreadas.

robots.txt controla o rastreamento, não permissões de acesso. Não deve proteger conteúdo privado ou arquivos confidenciais, e não garante que páginas bloqueadas não apareçam nos resultados. Para páginas que devem continuar acessíveis, mas não indexadas, use a diretiva noindex.

Publicar o arquivo robots.txt

Quando o robots.txt estiver pronto, salve-o como robots.txt e envie para a raiz do site, para ficar disponível em:

https://yourdomain.com/robots.txt

Boas práticas

  • Teste o robots.txt no Google Search Console depois de publicar.
  • Não use robots.txt para proteger conteúdo sensível: use autenticação.
  • Evite bloquear CSS, JavaScript ou imagens de que os mecanismos de busca precisam para renderizar as páginas.
  • Crie grupos de user-agent separados só quando rastreadores diferentes realmente precisarem de regras diferentes.
  • Mantenha o robots.txt simples e bloqueie só os caminhos que você não quer rastreados.
  • robots.txt controla o rastreamento, não a indexação. Uma página bloqueada ainda pode aparecer nos resultados se outras páginas apontarem para ela.

Privacidade

Tudo o que você cria fica no seu dispositivo.

  • Tudo o que você cria e edita fica no navegador.
  • Não é preciso se cadastrar nem criar uma conta.
  • Os rascunhos ficam no seu dispositivo, não nos servidores da Contismo.

Perguntas frequentes

robots.txt é um arquivo de texto na raiz do site que dá instruções aos rastreadores sobre quais partes devem ou não ser rastreadas. Só vale para rastreadores que escolhem seguir o padrão.

Envie o arquivo para a raiz do site para que fique em https://yourdomain.com/robots.txt. Os mecanismos de busca procuram nesse lugar; em outro endereço o efeito não será o esperado.

Não necessariamente. Se você não precisa restringir o rastreamento nem anunciar o sitemap XML, o site pode funcionar bem sem um. Muitos sites pequenos não precisam de robots.txt.

Não. Cada site deve ter um único robots.txt na raiz do domínio. Esse arquivo pode ter vários grupos de user-agent, regras de rastreamento e diretivas Sitemap.

robots.txt controla se os rastreadores são orientados a rastrear uma URL. As tags meta robots e o cabeçalho HTTP X-Robots-Tag controlam se o conteúdo pode ser indexado depois de rastreado.

Use robots.txt para o rastreamento do site inteiro e meta robots quando precisar de controle de indexação por página.

Sim. Bloquear uma página no robots.txt não garante que ela não apareça nos resultados. Se outros sites apontarem para ela, os mecanismos de busca podem indexar a URL sem rastrear o conteúdo. Use noindex se quiser evitar a indexação.

Sim. Você pode adicionar várias entradas Sitemap a um robots.txt. Isso é comum em sites que publicam sitemaps separados para páginas, imagens, vídeos, notícias ou outros tipos de conteúdo.

Sim. Você pode importar de uma URL pública, carregar um rascunho salvo no navegador ou colar o conteúdo direto no gerador.

Não. Os rascunhos ficam no navegador e não são enviados aos servidores da Contismo. Ao importar de uma URL, só essa URL é enviada para buscar o arquivo.

Pronto para criar algo incrível?

Junte-se a mais de 5000 equipes que constroem com a Contismo. Publique seu primeiro modelo de conteúdo em menos de 5 minutos.