Comecemos pela conclusão: bloquear o Google-Extended não fará seu site desaparecer do AI Overviews. É comum tratar as duas coisas como se fossem iguais. Por isso, algumas pessoas adicionam uma regra de bloqueio do Google-Extended ao robots.txt esperando controlar se o resumo de IA do Google poderá citar seu conteúdo. Depois descobrem que o resumo continua aparecendo e que a única mudança foi a exclusão do conteúdo do treinamento do Gemini. O Google-Extended determina se o material pode ser usado para treinar modelos generativos; as citações no AI Overviews seguem outro fluxo.
Afinal, o que é o Google-Extended?
O Google-Extended é um controle independente lançado pelo Google em setembro de 2023. Ele é configurado no robots.txt e define se o Google pode usar suas páginas para treinar e aprimorar os modelos da família Gemini e as APIs generativas do Vertex AI. Há um detalhe importante que costuma passar despercebido: o Google-Extended não é um rastreador e não acessa sites por conta própria. Quem faz o rastreamento continua sendo o Googlebot; o Google-Extended funciona apenas como uma chave que determina se o conteúdo rastreado poderá ser usado em IA generativa.
Por isso, ele não interfere na indexação nem no posicionamento na busca do Google. Mesmo que você o bloqueie, o Googlebot continuará rastreando a página, ela poderá permanecer no índice e seu ranking não cairá por esse motivo. A orientação oficial do Google é clara: bloquear o Google-Extended não altera sua posição nos resultados de busca. Isso explica por que tantas pessoas têm a impressão de que “nada aconteceu” depois da configuração — para a busca, de fato, nada mudou.
Por que o bloqueio não afeta o AI Overviews?
O AI Overviews e o AI Mode são recursos da busca do Google. As fontes usadas por eles vêm do índice de busca criado pelo Googlebot, e não do Google-Extended. A possibilidade de seu conteúdo ser citado pelo AI Overviews depende, na prática, de sua visibilidade na busca orgânica: a página pode ser rastreada? Está indexada? Sua estrutura facilita a extração de uma resposta que possa entrar diretamente no resumo? A configuração do Google-Extended não interfere nesse fluxo.
Como configurar o Google-Extended no robots.txt
O arquivo robots.txt deve ficar no diretório raiz do site. Para impedir por completo que o conteúdo seja usado no treinamento do Gemini, aplique Disallow a esse token. Para permitir o uso, escreva Allow ou simplesmente não inclua nenhuma regra, já que o padrão é permitir. Também é possível controlar caminhos específicos: você pode bloquear apenas a área de membros ou determinados diretórios e manter o restante liberado. Essas regras são independentes das aplicadas ao Googlebot e não se sobrepõem. Assim, é possível desativar o uso para treinamento sem fechar o acesso da busca.
- Bloquear totalmente o uso para treinamento: User-agent: Google-Extended e, em seguida, Disallow: /
- Permitir tudo (configuração padrão): não adicione nenhuma regra ou use User-agent: Google-Extended seguido de Allow: /
- Bloquear apenas diretórios específicos: use User-agent: Google-Extended seguido de Disallow: /members/ e mantenha o restante liberado
- Depois da alteração, use o teste de robots.txt do Google Search Console ou abra diretamente yourdomain.com/robots.txt no navegador para confirmar que a configuração entrou em vigor.

Vale a pena bloquear? Três cenários
A decisão depende do papel do seu conteúdo: ele é um ativo que precisa ser protegido ou um material de marketing que você quer tornar visível para mais pessoas e modelos? Estes três cenários ajudam a definir a abordagem adequada.
- O próprio conteúdo é um ativo monetizável — como pesquisa original, conhecimento pago ou relatório exclusivo: a tendência é bloquear o uso para treinamento, evitando alimentar modelos gratuitamente, mas preservar as oportunidades de citação na busca e no AI Overviews.
- Em B2B SaaS, o objetivo é fazer a marca aparecer nas respostas de IA: em geral, não há necessidade de bloquear. Permitir que o conteúdo seja amplamente assimilado pode aumentar a chance de a empresa ser recomendada espontaneamente pelo assistente de IA.
- Se houver questões de licenciamento, conformidade jurídica ou conteúdo sensível: bloqueie diretórios específicos em vez de aplicar uma restrição a todo o site e mantenha o conteúdo público de marketing disponível para treinamento.
Não confunda rastreadores de treinamento com rastreadores de recuperação
Este é um dos erros de GEO mais comuns — e mais caros. No universo da IA, há basicamente dois tipos de rastreador: os de treinamento alimentam os modelos com conteúdo; os de recuperação acessam informações no momento da consulta para gerar respostas e indicar fontes. Google-Extended, GPTBot, Applebot-Extended e ClaudeBot pertencem ao primeiro grupo; OAI-SearchBot, PerplexityBot e Googlebot, ao segundo. Na tentativa de “proteger o conteúdo”, algumas empresas bloqueiam os dois tipos de uma só vez. O resultado é que não reduzem o que o modelo já aprendeu e ainda desaparecem da lista de referências da IA.
- GPTBot (treinamento da OpenAI): bloqueá-lo impede que o conteúdo seja usado no treinamento do ChatGPT, mas não impede que a busca do ChatGPT encontre você.
- OAI-SearchBot (busca da OpenAI): bloqueá-lo impede que a busca do ChatGPT acesse seu conteúdo e apresente seu site como fonte.
- PerplexityBot (busca da Perplexity): bloqueá-lo impede que seu conteúdo seja incluído nas respostas da Perplexity.
- Google-Extended (treinamento do Google): bloqueá-lo impede que o conteúdo entre no treinamento do Gemini, mas ele ainda poderá ser citado pelo AI Overviews.
- Googlebot: é o canal vital. Bloqueá-lo significa sair ao mesmo tempo da busca e do AI Overviews. Quase nunca se deve mexer nessa permissão.
Como realmente influenciar a exibição do seu conteúdo no AI Overviews?
Atualmente, o Google não oferece um controle específico para “sair do AI Overviews e manter os snippets da busca convencional”. O que existe são controles de recuperação no nível da busca: nosnippet impede a exibição de qualquer resumo, max-snippet limita seu tamanho e data-nosnippet marca uma parte da página que não deve ser recuperada. O problema é que essas configurações também afetam os resumos dos resultados convencionais, um custo que raramente compensa. Em vez de procurar uma saída, é mais prático criar conteúdo que possa ser citado com clareza: perguntas bem definidas, respostas diretas e parágrafos que façam sentido de forma independente. Assim, a IA terá mais condições de citar sua página — e de fazê-lo com precisão.
Voltando à pergunta inicial: bloquear o Google-Extended não impedirá o AI Overviews de citar seu conteúdo, porque os dois pertencem a fluxos diferentes. O ponto que realmente merece atenção é verificar se você bloqueou rastreadores de busca sem perceber e, com isso, excluiu seu próprio site das referências de IA. Se não souber quais rastreadores de IA estão permitidos ou bloqueados no robots.txt do seu site, agende um diagnóstico de GEO de 30 minutos com a Tenten GEO. Nossa equipe revisará de uma só vez as configurações de treinamento e recuperação e indicará o que deve permanecer liberado ou bloqueado.



