Sobre o bloqueio de motores de pesquisa no Robots.txt
O que significa, na prática, estar bloqueado?
Uma regra no robots.txt indica a um rastreador que não deve obter um determinado caminho. Quando aplicada a todo o site, impede os motores de pesquisa de lerem qualquer conteúdo, fazendo com que tudo o que depende disso deixe de funcionar: não é descoberto conteúdo novo, e as páginas existentes ficam desatualizadas e acabam por ser removidas.
Este verificador lê o seu robots.txt e indica se os motores de pesquisa estão impedidos de aceder ao seu site.
É a única linha que pode causar mais danos a um site, e tem apenas uma linha.
Como acontece
Quase sempre por acidente, e quase sempre da mesma forma: é criado um site de teste com uma diretiva de bloqueio global para impedir que apareça nos resultados, e o ficheiro é colocado online juntamente com o resto da implementação.
Os sistemas de gestão de conteúdos têm a sua própria versão disto. Na maioria deles existe uma opção «desencorajar os motores de pesquisa», que é ativada durante o desenvolvimento e raramente volta a ser considerada.
Nada fica visivelmente danificado quando isso acontece. O site funciona perfeitamente para todas as pessoas que o visitam, e é por isso que muitas vezes passam semanas até alguém relacionar a diminuição do tráfego com a causa.
Bloquear não é o mesmo que remover
Esta é a parte que surpreende as pessoas. Uma página bloqueada pode continuar a aparecer nos resultados, listada sem descrição, porque foi dito ao rastreador para não a ler, mas não para a excluir.
Para manter corretamente uma página fora dos resultados, é necessária uma diretiva noindex, o que significa que o rastreador tem de ter autorização para obter a página e detetá-la. O bloqueio e a desindexação seguem direções opostas.
Por isso, o robots.txt é a ferramenta errada para a privacidade. Controla o rastreamento, não a visibilidade, e o próprio ficheiro é público.
O robots.txt ainda é relevante em 2026?
Está a montante de tudo. O conteúdo, a estrutura, a velocidade e os links partem do princípio de que um rastreador consegue aceder à página em primeiro lugar, e nenhum deles ajuda se não conseguir.
Também passou a desempenhar uma segunda função. O mesmo ficheiro determina agora se os rastreadores de IA podem ler o seu site, o que decide se as suas páginas podem ser citadas em respostas geradas.
Para um ficheiro que normalmente tem apenas algumas linhas, tem um peso desproporcionado.
O que esta ferramenta verifica
Obtém o ficheiro robots.txt do domínio que introduzir e indica se as regras impediriam os motores de pesquisa de rastrear o seu site.
Um resultado aprovado significa que nada os está a bloquear ao nível do site. Não confirma que caminhos individuais estejam acessíveis, por isso vale a pena verificar separadamente uma página que não seja indexada apesar deste resultado aprovado.
Próximos passos
Se o rastreamento estiver aberto, as questões seguintes são: o que pode ser descoberto e o que é deliberadamente excluído. Reveja todo o ficheiro
robots.txt, confirme que o seu
Mapa do site XML está presente e atualizado e certifique-se de que nenhuma etiqueta
noindex está a fazer discretamente aquilo que o robots.txt não faz.