Sobre os cabeçalhos Noindex
O que é um cabeçalho noindex?
Um cabeçalho noindex é uma instrução para manter uma página fora dos resultados de pesquisa, enviada com a resposta HTTP em vez de ser inserida no HTML da página. Tem a mesma função que uma etiqueta meta noindex; simplesmente chega por uma via diferente.
O cabeçalho que a transporta chama-se X-Robots-Tag, e verá esse nome utilizado indistintamente com cabeçalhos noindex na maioria da documentação. Também pode transportar outras diretivas, como nofollow ou noarchive, mas noindex é aquela cujas consequências vale a pena verificar.
Como a instrução é transmitida na resposta, pode aplicar-se a ficheiros que não têm HTML onde inserir uma meta tag: PDFs, imagens, folhas de cálculo, transferências. É também assim que as regras ao nível do servidor são aplicadas simultaneamente a diretórios inteiros.
Os cabeçalhos noindex ainda são relevantes em 2026?
São desproporcionalmente importantes porque são invisíveis. Um noindex no código-fonte da página pode ser encontrado por qualquer pessoa que o consulte; já num cabeçalho, não, e pode suprimir silenciosamente uma página durante meses, enquanto todos inspecionam o HTML e não encontram nada de errado.
Também são definidos na camada do servidor ou da CDN, o que significa que muitas vezes ficam completamente fora do sistema de gestão de conteúdos. A pessoa que está a depurar uma página que não é indexada frequentemente não tem acesso ao local onde a diretiva está definida.
Quando utilizados deliberadamente, continuam a ser a ferramenta adequada para ficheiros que não são HTML, uma necessidade genuinamente comum em sites que publicam documentos.
Como os cabeçalhos noindex se relacionam com a pesquisa por IA
Um cabeçalho noindex exclui conteúdo dos índices exatamente da mesma forma que uma meta tag e, consequentemente, do material em que se baseiam as respostas da IA. O custo de um cabeçalho acidental aumentou proporcionalmente.
É também cada vez mais utilizado para aplicar diretivas específicas de IA ao nível do ficheiro, o que faz com que valha a pena compreendê-lo, em vez de o tratar como um cabeçalho legado que já ninguém configura.
No caso dos documentos, em particular, isto funciona nos dois sentidos. Um PDF que preferia que não fosse citado deve ser excluído aqui; um PDF que pretende que seja encontrado não deve ser.
Práticas recomendadas para cabeçalhos noindex
- Verifique os cabeçalhos da resposta, e não apenas o HTML, quando uma página não for indexada.
- Utilize-os para ficheiros que não sejam HTML, nos quais uma meta tag não é uma opção.
- Mantenha as regras do servidor restritas. Uma regra aplicada a todo um diretório pode abranger facilmente mais do que o pretendido.
- Certifique-se de que o cabeçalho não contradiz a meta tag na mesma página.
- Não associe um cabeçalho noindex a um bloqueio no robots.txt; uma página bloqueada nunca é rastreada, pelo que o cabeçalho nunca é lido.
- Faça uma revisão após alterações no CDN ou no alojamento, que frequentemente reintroduzem predefinições.
Erros comuns
- Tentar resolver um problema de indexação exclusivamente no código-fonte da página, onde uma diretiva do cabeçalho é invisível.
- Aplicar uma regra a um diretório que também contém páginas que pretende que sejam indexadas.
- Deixar um cabeçalho da fase de teste implementado após o lançamento, no servidor em vez de no código.
- Partir do princípio de que um CDN transmite os cabeçalhos sem alterações, quando pode adicioná-los ou removê-los.
- Definir um cabeçalho e uma meta tag que entram em conflito e depois ficar surpreendido com qual deles prevalece.
O que esta ferramenta verifica
A ferramenta analisa os cabeçalhos da resposta HTTP da página e indica se está presente uma diretiva noindex X-Robots-Tag. A sua deteção é reportada como uma falha, partindo do princípio de que uma página que está a testar é uma página que pretende indexar.
Analisa apenas a resposta. Um noindex incluído no HTML da página é uma verificação separada, e vale a pena executar ambas em conjunto quando uma página não aparece nos resultados.
Próximos passos
Os problemas de indexação geralmente resumem-se a uma de três instruções. Verifique os
etiquetas meta noindex no HTML da página, reveja o seu
robots.txt para identificar um bloqueio de rastreio que impeça totalmente a leitura da página e confirme que a página está incluída no seu
Mapa do site XML.