Robots.txt para imobiliárias: bloqueie sem sumir do Google
Aprenda a configurar robots.txt em site imobiliário sem bloquear páginas importantes, evitando erro de indexação e perda de leads orgânicos no Google.
Robots.txt em sites imobiliários serve para orientar robôs de busca sobre o que podem acessar, mas não é botão de esconder página do Google. Use para bloquear áreas técnicas e filtros infinitos, mantendo páginas comerciais abertas e combinando sitemap, canonical e noindex quando necessário para preservar tráfego e leads.
O que é robots.txt na prática
O arquivo robots.txt é um arquivo simples, normalmente acessado em seudominio.com.br/robots.txt, que diz aos robôs dos buscadores quais caminhos do site eles podem ou não rastrear.
Em um site imobiliário, isso importa porque a estrutura costuma gerar muitas URLs automáticas: páginas de busca, filtros por preço, dormitórios, bairro, tipo de imóvel, ordenação, paginação, área útil e combinações quase infinitas.
Sem controle, o Google pode gastar tempo rastreando páginas sem valor, enquanto demora para encontrar as páginas que realmente trazem lead: imóveis ativos, páginas de bairro, páginas de cidade, conteúdos do blog e páginas institucionais.
Mas existe uma confusão perigosa: robots.txt controla rastreamento, não necessariamente indexação. Uma URL bloqueada pode continuar aparecendo no Google se outros sites linkarem para ela ou se o Google já a conhecia antes.
Quando uma imobiliária deve usar robots.txt
Use robots.txt para reduzir desperdício de rastreamento e proteger áreas que não precisam aparecer nos resultados. Não use como solução única para remover página do índice.
Bloquear filtros e parâmetros sem valor
Sites imobiliários costumam criar URLs como:
/imoveis?ordem=menor-preco/comprar/apartamento?quartos=2&banheiros=1&pagina=8/busca?preco_min=300000&preco_max=350000&vaga=1
Algumas dessas páginas podem ser úteis. Por exemplo, uma página bem estruturada para apartamento à venda no Centro pode ranquear. Mas combinações muito específicas, repetidas ou sem conteúdo próprio geralmente viram lixo de rastreamento.
O ideal é liberar páginas estratégicas e bloquear caminhos que geram variações infinitas sem demanda real.
Bloquear áreas administrativas
Páginas de login, painel interno, scripts de administração e ambientes de teste não devem ser rastreados. Exemplos comuns:
/admin//wp-admin//painel//login//homologacao/
Mesmo assim, se houver dados sensíveis, robots.txt não basta. Ele é uma orientação pública, não uma camada de segurança. Área privada precisa de autenticação, senha e controle técnico adequado.
Controlar páginas de busca interna
A busca interna do site pode gerar milhares de páginas parecidas. Se cada pesquisa vira uma URL indexável, o Google pode encontrar páginas vazias, duplicadas ou fracas.
Em muitos casos, vale bloquear /busca/ ou parâmetros como ?s= e deixar indexáveis apenas páginas planejadas: cidade, bairro, tipo de imóvel e guias locais. Para entender melhor como essas páginas estratégicas entram na arquitetura do site, veja o guia de páginas de bairro para SEO imobiliário.
O que não bloquear no robots.txt
Aqui mora o erro que derruba tráfego. Muita imobiliária bloqueia o que não deveria e depois não entende por que sumiu do Google.
Não bloqueie páginas de imóveis ativos
As páginas de imóveis ativos precisam ser rastreáveis. Mesmo que nem todas ranqueiem bem, elas ajudam o Google a entender o estoque, a localização, o padrão dos imóveis e a profundidade do site.
Bloquear /imovel/, /imoveis/ ou /comprar/ sem critério pode tirar do Google justamente as páginas que geram contato.
Se a preocupação é conteúdo duplicado entre imóveis parecidos, o caminho costuma ser melhorar descrições, fotos, dados estruturados e links internos, não bloquear tudo.
Não bloqueie CSS, JavaScript e imagens importantes
O Google precisa renderizar a página para entender experiência, layout e conteúdo. Se você bloqueia pastas de CSS, JavaScript ou imagens, pode prejudicar a leitura do site.
Isso é especialmente grave em sites imobiliários, onde fotos, carrossel, mapa, filtros e botões dependem desses arquivos. Bloquear recursos essenciais pode piorar indexação, experiência mobile e até Core Web Vitals.
Não use robots.txt para remover imóvel vendido
Se um imóvel foi vendido, bloquear a URL no robots.txt não resolve o problema. O Google pode manter a página indexada, sem conseguir rastreá-la para ver que mudou.
Para imóveis vendidos, existem caminhos melhores: manter a página com aviso e imóveis similares, redirecionar para uma categoria relevante ou remover com status adequado. A decisão depende do tráfego e da qualidade da URL. Esse tema tem um processo próprio em imóveis vendidos no site e SEO.
Exemplo simples de robots.txt para site imobiliário
Um arquivo básico poderia seguir esta lógica:
User-agent: *
Disallow: /admin/
Disallow: /painel/
Disallow: /login/
Disallow: /busca/
Disallow: /*?ordem=
Disallow: /*?pagina=
Allow: /wp-admin/admin-ajax.php
Sitemap: https://www.seudominio.com.br/sitemap.xml
Esse exemplo não deve ser copiado cegamente. Ele mostra a intenção: bloquear áreas sem valor para SEO, evitar alguns parâmetros e informar o sitemap.
Em WordPress, por exemplo, bloquear todo /wp-admin/ é comum, mas o admin-ajax.php pode ser necessário para funcionalidades do site. Em plataformas imobiliárias próprias, os caminhos mudam bastante.
Antes de publicar, peça ao desenvolvedor ou responsável pelo site para validar os caminhos reais.
Robots.txt, noindex e canonical: qual usar?
Essas três ferramentas resolvem problemas diferentes.
Robots.txt impede rastreamento
Use quando você não quer que o Google gaste tempo acessando uma área. É bom para login, painel, busca interna sem valor e parâmetros técnicos.
Mas se a página já está indexada, bloquear por robots.txt pode atrapalhar a remoção, porque o Google não consegue acessar a página para encontrar uma tag noindex.
Noindex remove ou evita indexação
Use noindex quando a página pode ser rastreada, mas não deve aparecer no Google. É útil para páginas de obrigado, páginas de campanha temporária, resultados internos fracos e algumas páginas duplicadas.
Para o Google ver o noindex, ele precisa conseguir rastrear a página. Portanto, não bloqueie no robots.txt uma página em que você depende de noindex.
Canonical consolida páginas parecidas
Use canonical quando existem páginas muito semelhantes e você quer apontar qual é a versão principal. Em imobiliárias, isso aparece muito em filtros, variações de URL e páginas com ordenações diferentes.
Se o problema do seu site é duplicidade de páginas parecidas, vale entender a lógica de canonical em sites imobiliários antes de sair bloqueando tudo no robots.txt.
Como revisar seu robots.txt sem quebrar o SEO
A revisão deve ser feita com calma. Um único bloqueio amplo pode tirar centenas de páginas importantes do rastreamento.
1. Acesse o arquivo atual
Digite no navegador:
seudominio.com.br/robots.txt
Veja se existe um arquivo, quais pastas estão bloqueadas e se o sitemap está informado. Se aparecer algo como Disallow: /, atenção: isso bloqueia o rastreamento do site inteiro para o robô indicado.
2. Liste as páginas que geram negócio
Antes de mexer, defina o que precisa ficar aberto:
- páginas de imóveis ativos;
- páginas de venda e locação;
- páginas de cidade;
- páginas de bairro;
- artigos do blog;
- páginas institucionais importantes;
- imagens públicas dos imóveis.
Tudo que gera lead, autoridade ou conteúdo relevante deve ser rastreável.
3. Identifique o lixo de rastreamento
Procure padrões de URLs que não deveriam competir no Google:
- buscas internas vazias;
- filtros sem demanda;
- ordenações por preço ou data;
- paginações muito profundas;
- URLs com parâmetros repetidos;
- ambientes de teste.
O objetivo não é esconder o site, é limpar o caminho para o Google encontrar o que importa.
4. Valide no Search Console
Depois de alterar, acompanhe o Google Search Console. Veja se páginas importantes continuam indexadas, se o sitemap está sendo lido e se surgiram avisos estranhos.
O robots.txt deve trabalhar junto com indexação e sitemap. Se esse ponto ainda está confuso, comece pelo guia de indexação e sitemap para site imobiliário.
Erros comuns em robots.txt de imobiliárias
Bloquear o site inteiro sem perceber
Isso acontece em migração, homologação ou lançamento de site novo. O desenvolvedor bloqueia tudo no ambiente de teste e esquece de liberar quando publica.
O resultado pode ser queda forte de impressões, páginas fora do índice e perda de leads orgânicos.
Bloquear pastas amplas demais
Um Disallow: /imoveis/ pode parecer inofensivo se a intenção era bloquear filtros, mas pode impedir o rastreamento de todo o estoque. Prefira regras específicas para parâmetros ou caminhos realmente problemáticos.
Achar que robots.txt é privacidade
Como o arquivo é público, qualquer pessoa pode acessá-lo. Não coloque caminhos sensíveis achando que isso protege informação. Se existe algo confidencial, proteja por login e permissão, não por robots.txt.
Não informar o sitemap
O sitemap não depende obrigatoriamente do robots.txt, mas incluir a linha do sitemap ajuda os robôs a encontrarem o mapa do site. Em sites com muitos imóveis, isso facilita a descoberta de novas páginas.
Rotina recomendada para imobiliárias
Revise o robots.txt em três momentos: criação do site, migração de plataforma e queda repentina de tráfego orgânico.
Também vale revisar quando a imobiliária adiciona filtros novos, muda URLs, troca plugin de imóveis ou cria páginas automáticas por cidade e bairro.
Na dúvida, seja conservador: bloqueie apenas o que você entende, monitore no Search Console e evite regras amplas. SEO técnico bom não é o mais complexo; é o que protege as páginas que trazem cliente.
Conclusão prática
O robots.txt da imobiliária deve limpar o rastreamento, não esconder oportunidades. Mantenha abertas as páginas que vendem, bloqueie áreas técnicas e filtros inúteis, informe o sitemap e use noindex ou canonical quando o problema não for rastreamento. Uma revisão simples pode evitar meses de perda orgânica.
Perguntas frequentes
Posso bloquear todos os filtros de imóveis no robots.txt?
Bloquear todos os filtros nem sempre é o melhor caminho. Alguns filtros têm busca real, como apartamento à venda em determinado bairro, e podem gerar leads qualificados. O ideal é bloquear combinações infinitas e sem valor, mantendo páginas planejadas para cidade, bairro, tipo de imóvel e intenção comercial.
Como saber se meu robots.txt está bloqueando páginas importantes?
Você deve comparar o robots.txt com as páginas que precisam aparecer no Google. Acesse o arquivo, veja os caminhos bloqueados e teste URLs importantes no Google Search Console. Se páginas de imóveis, bairros, blog ou cidade estiverem impedidas de rastreamento, revise a regra antes que o tráfego caia.
Robots.txt tira uma página do Google?
Robots.txt não é a melhor forma de tirar uma página do Google. Ele impede ou limita o rastreamento, mas uma URL já conhecida pode continuar aparecendo nos resultados. Para remover ou evitar indexação, normalmente é melhor usar noindex, redirecionamento, status correto ou ferramenta de remoção temporária.
Devo colocar o sitemap dentro do robots.txt?
Sim, colocar o sitemap no robots.txt é uma boa prática simples. Essa linha ajuda os robôs a encontrarem o mapa do site, principalmente em imobiliárias com muitas páginas de imóveis, bairros e conteúdos. Mesmo assim, o sitemap também deve ser enviado e monitorado pelo Google Search Console.