Gerador de Ficheiros Robots.txt
Gere facilmente um ficheiro robots.txt profissional de SEO para o seu website.
Ficheiro Robots.txt gerado
Gerador gratuito de ficheiros Robots.txt
O nosso gerador gratuito de ficheiros robots.txt cria um ficheiro robots.txt limpo e válido para o seu website em segundos. Adicione o URL do seu sitemap, liste os caminhos que pretende bloquear e gere um ficheiro pronto a usar que pode copiar ou descarregar. Não são necessários conhecimentos de sintaxe, registo ou qualquer outro motivo, e não corre o risco de erros de digitação que desindexam silenciosamente um site quando o ficheiro é escrito manualmente.
O ficheiro robots.txt controla a forma como os motores de busca rastreiam o seu site. Um único caractere incorreto pode bloquear todo o seu site no Google sem aviso prévio. Este gerador elimina este risco, criando o ficheiro a partir da sua informação, em vez de texto livre.
O que é um ficheiro robots.txt?
O ficheiro robots.txt é um ficheiro de texto simples localizado na raiz do seu domínio que indica aos motores de busca quais os URLs a que têm permissão para aceder. Encontra-se em seudominio.com/robots.txt e é o primeiro ficheiro que a maioria dos bots verifica antes de iniciar o rastreio. Controla o rastreio, não a indexação, pelo que uma página bloqueada ainda pode aparecer nos resultados de pesquisa se outros sites tiverem links para ela.
O ficheiro segue o Padrão de Exclusão de Robôs (Robots Exclusion Standard), um protocolo respeitado por todos os principais motores de busca. O Googlebot, o Bingbot e outros rastreadores bem-comportados lêem-no antes de solicitarem qualquer outra informação no seu site. Os bots maliciosos e de extração de dados geralmente ignoram-no completamente, e é por isso que o robots.txt nunca é uma ferramenta de segurança.
Segundo a Google, uma página bloqueada no robots.txt pode ainda ser indexada se existirem links para a mesma noutros sites, aparecendo geralmente sem descrição. Se o seu objetivo é impedir que uma página apareça nos resultados de pesquisa, o método correto é utilizar a tag noindex ou proteção por palavra-passe, e não uma regra de bloqueio.
Como utilizar este gerador de robots.txt
Para criar um ficheiro robots.txt, introduza o URL do seu sitemap, adicione os caminhos que pretende bloquear (um por linha) e clique em Gerar. A ferramenta criará um ficheiro corretamente formatado que poderá copiar ou descarregar. Faça o upload para a raiz do seu site para que fique acessível em seudominio.com/robots.txt e, em seguida, teste-o no Google Search Console.
- Introduza o URL do seu mapa do site. Isto direciona os rastreadores diretamente para as suas páginas mais importantes, por exemplo, https://yoursite.com/sitemap_index.xml.
- Adicione caminhos a bloquear. Liste um caminho por linha, como por exemplo /wp-admin/ ou /cart/. Deixe este campo em branco para permitir a indexação completa.
- Clique em Gerar. A ferramenta gera um ficheiro robots.txt limpo e válido, com a sintaxe e espaçamento corretos.
- Copie ou faça o download do ficheiro. Guarde o ficheiro como robots.txt com codificação UTF-8.
- Faça o upload para a raiz do seu site. Confirme se o site carrega corretamente em yoursite.com/robots.txt e, em seguida, teste os URLs importantes na Search Console.
Sintaxe do robots.txt: As diretivas explicadas
Um ficheiro robots.txt é construído a partir de quatro diretivas principais. User-agent direciona um tracker específico, Disallow bloqueia um caminho, Allow permite um caminho dentro de uma pasta bloqueada e Sitemap aponta para o seu sitemap XML. Cada regra fica na sua própria linha, os caminhos são sensíveis a maiúsculas e minúsculas e os rastreadores aplicam a regra correspondente mais específica, em vez da primeira listada.
Diretiva | O que faz | Exemplo |
Agente do utilizador | Nomeia o rastreador ao qual se aplica um bloco de regras. | Agente do utilizador: * |
Proibir | Impede que alguém rasteje por uma passagem. | Proibir: /wp-admin/ |
Permitir | Permite o acesso a um caminho dentro de uma pasta bloqueada. | Permitir: /wp-admin/admin-ajax.php |
Mapa do site | Indica aos rastreadores onde se encontra o seu sitemap. | Mapa do site: https://site.com/sitemap.xml |
Atraso de rastejamento | Solicita aos bots que aguardem entre pedidos (ignorado pelo Google) | Atraso de rastejamento: 10 |
O asterisco em Agente do utilizador: * é um joker que significa todos os rastreadores. Para direcionar um bot específico, nomeie-o diretamente, como Agente do utilizador: GooglebotUm valor "Disallow" em branco permite tudo, enquanto Proibir: / Bloqueia todo o site.
O que permitir e o que proibir
Bloqueie caminhos sem valor de pesquisa que desperdiçam o orçamento de rastreio, como páginas administrativas, URLs de carrinho e de finalização de compra, resultados de pesquisa interna e URLs de filtro de duplicados. Nunca bloqueie pastas de CSS, JavaScript ou imagens que os motores de busca necessitam para renderizar as suas páginas, pois uma página que não pode ser renderizada corretamente pode ter a sua qualidade avaliada erradamente durante a indexação.
Os caminhos comuns que vale a pena bloquear na maioria dos sites incluem:
- /wp-admin/ permitindo /wp-admin/admin-ajax.php
- páginas de resultados de pesquisa interna como /?s=
- URLs do carrinho, da página de checkout e da conta nas lojas de comércio eletrónico
- Pastas de teste ou de desenvolvimento
- Páginas de agradecimento e confirmação sem intenção de pesquisa
Os motores de busca funcionam com um orçamento de rastreio, que é o número de páginas que um robô irá rastrear num determinado período. Bloquear secções de baixo valor ajuda os rastreadores a gastar esse orçamento nas páginas que realmente geram tráfego. Isto é ainda mais importante à medida que um website cresce, uma vez que 91% das páginas não recebem qualquer tráfego orgânico do Google, de acordo com [fonte não especificada]. AhrefsE a acumulação de dejetos rastejantes só aumenta essa diferença.
Controlando os rastreadores de IA em 2026
Um ficheiro robots.txt moderno já não se limita ao Googlebot e ao Bingbot. Agora pode permitir ou bloquear rastreadores de IA como GPTBot, ClaudeBot, Google-Extended e PerplexityBot, bem como rastreadores de SEO como AhrefsBot e SemrushBot. Cada um é controlado pelo seu próprio bloco User-agent, dando-lhe controlo direto sobre quais os bots que podem aceder ao seu conteúdo para treino ou indexação.
Se quiser impedir que um rastreador de IA específico utilize o seu conteúdo, adicione um bloqueio dedicado para o mesmo:
- Agente do utilizador: GPTBot depois Proibir: / bloqueia o rastreador da OpenAI
- Agente do utilizador: Google-Extended depois Proibir: / Opta por não participar na formação de IA do Google, mas mantém a indexação normal das pesquisas.
- Agente do utilizador: CCBot depois Proibir: / Bloqueia o bot Common Crawl utilizado por muitos conjuntos de dados de IA.
O bloqueio destes motores de busca não afeta o seu posicionamento normal nos resultados de pesquisa do Google ou do Bing, uma vez que utilizam agentes de utilizador diferentes. Trata-se puramente de um controlo sobre a inteligência artificial e o acesso a dados de terceiros.
Ficheiro robots.txt para WordPress
O WordPress gera um ficheiro robots.txt virtual automaticamente, mas o carregamento de um ficheiro personalizado oferece um controlo real. Uma configuração segura do WordPress bloqueia a área administrativa e a pesquisa interna, permitindo o acesso ao ficheiro admin-ajax.php e a exibição do seu sitemap. Nunca bloqueie a pasta /wp-content/ por completo, pois contém ficheiros de temas e plugins necessários para o Google renderizar as suas páginas.
Um modelo inicial limpo para um site WordPress tem o seguinte aspeto:
Agente do utilizador: *
Proibir: /wp-admin/
Proibir: /?s=
Permitir: /wp-admin/admin-ajax.php
Mapa do site: https://yoursite.com/sitemap_index.xml
Substitua o URL do sitemap pelo seu próprio, gere o ficheiro acima e faça o upload para o diretório raiz. Se gere uma loja virtual, adicione os caminhos do carrinho, do checkout e da minha conta à lista de permissões.
Erros comuns no ficheiro robots.txt que deve evitar.
O erro mais prejudicial no ficheiro robots.txt é deixar a linha `Disallow: /` no ficheiro activo, o que bloqueia todo o seu site. Outros erros frequentes incluem bloquear ficheiros CSS e JavaScript, listar páginas sensíveis que o ficheiro depois divulga publicamente e assumir que o robots.txt remove páginas do índice do Google quando, na verdade, apenas controla a indexação.
- O bloqueio total acidental. Um rafeiro Proibir: / Instrui todos os rastreadores a ignorarem todo o seu site. Isto acontece normalmente quando um ficheiro de teste é publicado durante uma migração.
- Bloqueio de ficheiros críticos para a renderização. Desativar o CSS ou JS do tema impede o Google de ver a sua página da mesma forma que um utilizador a vê, o que pode prejudicar o posicionamento nos resultados de pesquisa, especialmente em construtores visuais como o Elementor.
- Utilizando o ficheiro robots.txt para fins de privacidade. O ficheiro é público, pelo que listar um caminho sensível apenas revela a todos onde está. Use proteção por palavra-passe ou noindex em vez disso.
- Diferenciação entre maiúsculas e minúsculas. Os caminhos diferenciam maiúsculas de minúsculas, pelo que /Fotografia/ e /fotografia/ são tratados como diretórios diferentes.
Utilizar um gerador em vez de escrever o ficheiro manualmente elimina quase todos estes riscos, uma vez que a sintaxe é construída corretamente a partir das suas entradas de cada vez.
Robots.txt vs Sitemap vs Noindex
Estes três elementos têm funções diferentes. O robots.txt controla quais os caminhos que os rastreadores podem aceder, um sitemap lista os URLs que pretende que sejam rastreados e indexados, e a etiqueta noindex impede que uma página rastreável apareça nos resultados de pesquisa. Uma configuração de SEO técnico adequada utiliza o robots.txt e um sitemap em conjunto, reservando a tag noindex para páginas que devem permanecer fora dos resultados do Google.
Um erro comum é contradizer estes sinais, por exemplo, listar um URL no seu sitemap enquanto o bloqueia no robots.txt. Se pretender remover uma página dos resultados de pesquisa, permita a indexação e adicione uma etiqueta noindex, uma vez que o Google não consegue ler uma etiqueta noindex numa página que não tem permissão para indexar. Para uma explicação mais detalhada, consulte os nossos guias sobre o assunto. blog de SEO.
Porque é que um ficheiro robots.txt adequado ajuda no seu SEO?
Um ficheiro robots.txt bem configurado melhora o SEO ao direcionar os rastreadores para as suas páginas valiosas e afastá-los das de baixo valor, preservando o orçamento de rastreio e ajudando a que o conteúdo importante seja indexado mais rapidamente. Embora o robots.txt não seja um fator de classificação direto, a eficiência do rastreio afeta diretamente a rapidez e a abrangência do processamento do seu website.
Os backlinks continuam a ser um dos três principais fatores de classificação do Google, e toda esta autoridade conquistada não importa se os problemas de rastreio impedirem que as suas melhores páginas sejam processadas corretamente. Autoridade de domínioA pontuação Moz, que varia de 1 a 100 e se baseia principalmente em sinais de backlinks, cresce mais rapidamente em sites onde a indexação e o rastreio são executados corretamente. Depois de configurar o seu ficheiro robots.txt, verifique a sua autoridade com a nossa ferramenta. Ferramenta DA PA gratuita e procure links quebrados que prejudicam a indexação utilizando a nossa ferramenta. Verificador de links partidos em massa.
Perguntas frequentes
Este gerador de robots.txt é gratuito?
Sim, o nosso Gerador de Ficheiros Robots.txt é totalmente gratuito, sem registo ou limites. Introduza o seu sitemap e os caminhos proibidos, gere o ficheiro e copie ou descarregue-o instantaneamente. Pode voltar e gerar um ficheiro atualizado sempre que a estrutura do seu site mudar, além de contar com o nosso conjunto completo de ferramentas. ferramentas de SEO gratuitas.
Onde devo colocar o ficheiro robots.txt depois de o gerar?
Faça o upload para o diretório raiz do seu site para que este seja carregado para o seudominio.com/robots.txt. Não funcionará numa subpasta. No WordPress, pode fazer o upload via FTP ou colar o conteúdo no editor de robots.txt do seu plugin de SEO, como o Yoast ou o Rank Math.
O ficheiro robots.txt remove as minhas páginas do Google?
Não. O ficheiro robots.txt apenas controla a indexação, não o rastreio. Uma página bloqueada pode ainda aparecer nos resultados de pesquisa se outros sites tiverem links para a mesma, geralmente sem descrição. Para remover uma página dos resultados de pesquisa, utilize a etiqueta noindex numa página rastreável ou proteja-a com uma palavra-passe.
Posso bloquear rastreadores de IA como o GPTBot usando o ficheiro robots.txt?
Sim. Adicione um bloco de User-agent específico para o bot, como o GPTBot, ClaudeBot ou Google-Extended, seguido de Disallow:/ para o bloquear. Isto impede que o rastreador de IA aceda ao seu conteúdo sem afetar o seu posicionamento normal nos resultados de pesquisa do Google ou do Bing, uma vez que estes motores utilizam User-Agents diferentes.
Como faço para testar o meu ficheiro robots.txt depois de o enviar?
Abra o Google Search Console e utilize a ferramenta de Inspeção de URLs em algumas páginas importantes para confirmar se não estão a ser bloqueadas inesperadamente. Teste sempre antes e depois das alterações, pois um único caractere fora do lugar pode bloquear muito mais do que o pretendido. Combine isto com uma verificação rápida de autoridade utilizando a nossa ferramenta de pesquisa. verificador de autoridade de domínio em massa.
Gere o seu ficheiro robots.txt agora mesmo.
Volte ao início da página, insira o URL do seu sitemap e quaisquer caminhos que queira bloquear e gere um ficheiro robots.txt limpo e válido em segundos. É gratuito, não requer registo e elimina o risco de gralhas que surge ao escrever o ficheiro manualmente. Depois de a sua configuração de rastreio estar correta, explore o nosso Conjunto completo de ferramentas de SEO ou obtenha uma segunda opinião de um dos nossos especialistas. consultor especialista em SEO serviço.