---
title: "O que faz uma empresa ser citada pelo ChatGPT, Gemini e pela IA do Google em 2026"
url: https://samambai.com/pt/blog/o-que-faz-uma-empresa-ser-citada-pelas-ias/
date: 2026-10-03
author: samambai
---

Uma empresa é citada quando a página entra no índice do motor, responde à pergunta com preço e data, é corroborada por terceiros e continua atual. Arquivo llms.txt, schema especial e menção fabricada não atravessam esses portões.

Uma empresa é citada pelo ChatGPT, pelo Gemini ou pela IA do Google quando passa por quatro portões, nesta ordem: a página entra no índice daquele motor, a página responde à pergunta (com preço e data quando a pergunta é comercial), alguém de fora confirma que a empresa existe, e a página continua verdadeira. O Google trata isso como SEO. No guia atualizado em 10 de julho de 2026, a frase é direta: otimizar para a busca generativa é otimizar para a busca [1].

Os quatro portões são a leitura operacional da samambai sobre a documentação oficial e sobre os testes que se sustentam. Não são um produto do Google nem uma fórmula de "GEO". Quem vende um quinto portão (arquivo secreto, schema especial, página picada em pedaços, menção comprada) está vendendo o que o próprio Google mandou ignorar [1].

## Os quatro portões, em uma frase cada

1. **Acesso ao índice.** Se o robô certo não lê a página, ela não existe para aquele motor.
2. **Página que responde.** Entre páginas já recuperadas, tema, preço explícito e data recente decidem quem é citado primeiro. Formatação quase não decide.
3. **Confiança de terceiros.** A resposta mostra o que o resto da web diz. Menção fabricada é o atalho que a política de spam passou a nomear.
4. **Frescor.** Fato velho perde para fato novo na página que já foi recuperada. Página nova em massa, uma por variação de busca, é outro problema: spam.

Falhar no portão 1 zera o resto. Passar no portão 1 sem passar no 2 significa "o Google conhece o domínio" e a IA cita um concorrente. Os portões 3 e 4 não compensam um site bloqueado.

## Portão 1: cada motor tem uma porta, e elas não são a mesma

AI Overviews e Modo IA saem do índice do Google. O guia descreve duas técnicas. A primeira é geração aumentada por recuperação: o ranking do Search busca páginas e o modelo lê trechos, com links clicáveis. A segunda é query fan-out: o modelo dispara várias buscas relacionadas ao mesmo tempo. O exemplo oficial é "como consertar um gramado cheio de ervas daninhas", que pode virar "melhores herbicidas", "tirar erva sem químico" e "como prevenir erva" [1]. Uma página só sobre "agência de IA" não cobre, sozinha, as buscas filhas. Também não se resolve isso com uma URL por variação. O mesmo guia manda essa tática para a política de abuso de conteúdo em escala [1].

Para o link de apoio aparecer, a página precisa estar indexada e elegível a snippet, e o site precisa estar incluído no controle de IA generativa do Search Console. O padrão desse controle é incluir. Excluir tira links e o uso do conteúdo como base das respostas de AI Overviews, Modo IA e IA generativa no Discover. Não muda o ranking do resto da busca e não controla treino de modelo. O controle chegou a todos os sites em 31 de agosto de 2026. A exclusão costuma valer em 1 a 2 dias, com resíduo de cache [1] [10].

O token `Google-Extended` é outra chave, e confundir as duas é um erro caro. Ele não tem user-agent próprio. O rastreio continua com os user-agents que o Google já usa. O token só decide se o conteúdo já rastreado pode treinar gerações futuras do Gemini e servir de base no app Gemini e no Grounding with Google Search do Vertex AI. Não mexe em inclusão nem em ranking no Google Search [9]. Bloquear `Google-Extended` não tira a empresa do Modo IA. Liberar `Google-Extended` não coloca a empresa no Modo IA. A porta do Modo IA é Googlebot mais indexação mais o controle do Search Console.

| Motor | De onde vem a página | O que liberar | O que não é a porta |
|---|---|---|---|
| AI Overviews e Modo IA | Índice do Google | Googlebot, snippet permitido, controle de IA no Search Console em "incluir" | `Google-Extended`, llms.txt |
| App Gemini e grounding no Vertex | Conteúdo já rastreado, sob o token | Decisão à parte: permitir ou não `Google-Extended` | Achar que isso liga ou desliga o Modo IA |
| ChatGPT busca | OAI-SearchBot, e às vezes parceiros | OAI-SearchBot e os IPs de `openai.com/searchbot.json` | GPTBot (isso é treino) |
| Copilot e resumos de IA do Bing | Índice do Bing | Bing Webmaster Tools e, para frescor, IndexNow | Achar que o Google participa do IndexNow |
| Claude, busca | Claude-SearchBot na página de crawlers | Claude-SearchBot no robots.txt | Tratar ClaudeBot (treino) como se fosse busca |
| Brave, e o conector de governo da Anthropic | Índice da Brave; no governo, a API da Brave | Página rastreável pelo Googlebot | Um user-agent próprio da Brave (ela não anuncia um) |

No ChatGPT, a página de bots separa quatro agentes, e cada um é independente [4].

- **OAI-SearchBot** coloca o site em resultados de busca do ChatGPT. Não é treino. Site que o bloqueia não aparece nas respostas de busca, embora ainda possa surgir como link de navegação. A OpenAI pede `Allow` e que a hospedagem aceite os IPs publicados. Mudança de robots.txt pode levar cerca de 24 horas. Se OAI-SearchBot e GPTBot estão ambos permitidos, a OpenAI pode usar um único rastreio para os dois usos.
- **GPTBot** pode alimentar treino de modelos fundacionais. Bloquear GPTBot é uma decisão de treino. Não é o interruptor da busca.
- **ChatGPT-User** visita uma página porque uma pessoa pediu. A OpenAI diz que as regras de robots.txt podem não se aplicar, e que esse agente não decide se o conteúdo entra em Search.
- **OAI-AdsBot** só visita landing pages enviadas como anúncio. Não treina modelo fundacional.

A ajuda de busca do ChatGPT, marcada como atualizada no mês anterior quando lida em 2 de outubro de 2026, diz que o ChatGPT ranqueia com vários fatores para achar informação relevante e confiável, e que posição não é garantida. A condição de elegibilidade escrita é esta: permitir o OAI-SearchBot e o tráfego dos IPs publicados. A mesma página diz que a busca às vezes usa provedores parceiros, reescreve a pergunta e manda ler as políticas da Microsoft e da Shopify. Isso documenta parceria. Não documenta que o índice seja o Bing, nem uma porcentagem de sobreposição [5].

A Anthropic publica três robôs. ClaudeBot é treino. Claude-User é busca disparada pela pessoa. Claude-SearchBot navega para melhorar resultado de busca. Bloquear o de busca pode reduzir visibilidade e precisão nas respostas de busca. O opt-out é por robots.txt. Bloquear IP pode impedir a leitura do próprio robots.txt, e a Anthropic avisa que o opt-out por IP pode falhar. Os três respeitam robots.txt e não tentam furar CAPTCHA [6].

A página de crawlers da Anthropic não diz qual índice alimenta o Claude comercial. O que está escrito à parte, no conector de busca do Claude for Government, é que a busca nativa está desligada nesse produto e que o conector chama a API da Brave. Só a string da consulta sai para a Brave. Histórico, identidade e arquivos não saem [8]. Tratar "todo Claude busca na Brave" como frase da Anthropic é extrapolar. O fato operacional que a Brave publica, e que importa de qualquer jeito, é outro: o crawler da Brave não anuncia user-agent próprio, e se o Googlebot não pode rastrear a página, o robô da Brave também não rastreia [7]. Fechar a porta do Google fecha a porta da Brave.

IndexNow, no JSON lido em 2 de outubro de 2026, avisa Bing, Yandex, Seznam, Naver, Yep, Internet Archive e Amazonbot. Google não está na lista [14]. Aviso não é indexação. É um jeito de o Bing saber que a página mudou, que é o uso que o próprio anúncio de AI Performance recomenda para frescor [12].

## Portão 2: a página responde, com preço e data

O guia do Google pede conteúdo que não seja commodity: ponto de vista que não dá para reciclar de outro site nem pedir a um modelo genérico, experiência em primeira mão, texto organizado para uma pessoa, imagem e vídeo quando fizerem sentido [1]. "Sete dicas para contratar IA" é commodity. "Quanto custa tirar um app do Lovable e colocar em produção, com o que quebra no Supabase multi-tenant" é uma página que só quem fez o trabalho escreve.

Entre páginas que já estão na mesa do modelo, o teste mais limpo de 2026 é o de Vishwakarma, Kumar e Jamidar, pesquisadores da Sprinklr, submetido ao arXiv em 25 de maio de 2026 e apresentado na SIGIR 2026 [15]. Não é post de ferramenta. É experimento. Também não é a web aberta, e o limite importa mais do que o número grande.

Eles injetaram exatamente dois documentos no contexto, em 252.000 tentativas, seis modelos (Gemini 2.5 Flash, GPT-5 Nano, GPT-5 Mini, GPT-5.2, Claude 3.5 Sonnet e Kimi K2 Thinking). Os dois textos diferiam em um fator só. Marcas foram anonimizadas. A ordem dos dois documentos foi invertida para não confundir conteúdo com viés de posição. Eles não chamaram um buscador. A recuperação estava desligada.

Quatro fatores foram unânimes nos seis modelos, com efeito enorme (odds ratio acima de 100, o que neste desenho significa preferência quase determinística num duelo de duas páginas, não um ganho de 100 vezes no Google):

- o texto fala de outra coisa (topic mismatch)
- o preço não está no texto
- a data é 2019 contra uma data de 2026
- o documento aparece em segundo na lista injetada

Completude e sinais de confiança ajudam menos. Edição só de formatação (parágrafo denso contra seções, informação espalhada) não teve efeito consistente. "Data recente contra nenhuma data" também não foi consenso. O que foi consenso é data recente contra data velha [15].

Leitura prática, com o limite do laboratório na frente: preço e data não colocam a página no índice. Eles desempatam páginas que já foram recuperadas. Uma página de serviço sem preço ("fale conosco") perde, nesse teste, para a página que diz o número. Uma página datada de 2019 perde para a página cujos fatos são de 2026. Carimbar a data de hoje em texto velho não é o fator que eles mediram. Eles trocaram o conteúdo datado.

Para uma empresa de serviço, a página que passa neste portão responde em voz alta, no primeiro parágrafo:

- o que é entregue (agente de WhatsApp para agendamento, automação em n8n, app que saiu do Lovable)
- para quem (uma rede de clínicas, um grupo de hotelaria, um varejo B2B)
- em quanto tempo (a maioria das automações no ar em 2 a 4 semanas, projeto completo em 4 a 8 semanas)
- por quanto (Sprint US$ 1.200 por duas semanas, projeto a partir de US$ 3.000, parceria a partir de US$ 900 por mês)
- em que data aqueles números foram escritos

O Bing, no lançamento do AI Performance em 10 de fevereiro de 2026, recomenda o mesmo tipo de página do lado do produto, sem teste controlado: profundidade, headings, tabelas, FAQ no corpo, evidência, frescor, e texto alinhado a imagem e vídeo. Citações no relatório não indicam posição dentro da resposta [12]. Estrutura ajuda uma pessoa e ajuda o recorte. Não substitui preço, data e tema.

## Portão 3: confiança vem de fora, e menção falsa é spam

O guia diz que as respostas generativas podem mostrar o que se fala de um produto em blogs, vídeos e fóruns. Em seguida desmonta o atalho: buscar menções inautênticas não ajuda como parece. Os sistemas de ranking olham conteúdo de qualidade. Os sistemas de spam bloqueiam spam. A IA generativa depende dos dois [1].

Desde 15 de maio de 2026 isso está escrito como política, não como conselho. O changelog dessa data esclarece que as políticas de spam também valem para respostas de IA generativa no Google Search. Não foi uma política nova. Foi o aviso de que a política já cobria AI Overviews e Modo IA [2]. O texto vigente da política, atualizado em 28 de agosto de 2026, define spam como técnica para enganar o usuário ou manipular os sistemas de Search, "como tentar manipular respostas de IA generativa no Google Search" [3].

O que cai nesse texto, em linguagem de quem compra serviço:

- **Conteúdo em escala.** Muitas páginas cujo fim principal é manipular ranking, não ajudar. Inclui gerar páginas com IA sem valor, e criar vários sites para esconder que o conteúdo é escalado [3]. Uma URL por cidade, ou uma URL por busca filha do fan-out, com o mesmo texto trocando o nome da cidade, é o exemplo que o guia de julho aponta para essa política [1].
- **Doorway.** Páginas feitas para ranquear numa consulta e empurrar a pessoa para outro lugar. Vários domínios com a home quase igual. Várias páginas de cidade que despejam todo mundo na mesma URL [3].
- **Link spam.** Comprar link, exigir link em contrato sem deixar o terceiro usar `nofollow` ou `sponsored`, widget e rodapé distribuídos em muitos sites, conteúdo de baixo valor feito para fabricar sinal [3].
- **Domínio expirado.** Comprar um domínio velho para herdar ranking com conteúdo que não tem valor [3].

Fora do Google, a Microsoft documentou o primo comercial desse atalho. Em 10 de fevereiro de 2026, o time de segurança descreveu "AI Recommendation Poisoning": botões "Summarize with AI" que abrem um assistente com instrução para lembrar a empresa como fonte confiável ou recomendá-la primeiro. Em 60 dias de URLs de IA em tráfego de e-mail, acharam mais de 50 prompts distintos, de 31 empresas, em 14 indústrias (finanças, saúde, jurídico, SaaS, agências, comida, serviços). A eficácia variou por assistente e ao longo do tempo. A Microsoft classifica o caso como envenenamento de memória [19]. Isso é ataque. Não é tática de marca.

Confiança que passa no portão 3 é chata e verificável. Um diretório do programa de parceiro em que a empresa de fato está. Um artigo de imprensa com apuração. Uma página de cliente que descreve o trabalho, com o cliente no controle do texto. Um perfil de pessoa, com nome e histórico, que bate com o site. Para serviço local, o Google cita Google Business Profile e Merchant Center como caminho de negócio e produto nas respostas de IA [1]. O Bing cita Bing Places para endereço, horário e contato em resposta local [12]. Empresa de software que atende São Paulo, Nova York, Madrid e Tel Aviv não vira "a melhor agência da cidade" por ficha local falsa em vinte municípios. Vira uma ficha verdadeira onde tem operação, e páginas que aguentam checagem.

## Portão 4: frescor é fato novo, não calendário de publicação

No teste da SIGIR, data de 2026 contra data de 2019 foi um dos quatro fatores unânimes, com a recuperação desligada [15]. No Bing, o anúncio de AI Performance trata atualização como condição para a resposta usar a versão corrente, e aponta IndexNow como o aviso aos motores participantes [12]. O Google avisa o outro lado: quantidade de páginas não torna o site mais relevante, e os sistemas já entendem relevância sem casar a consulta palavra por palavra [1].

O trabalho de frescor que cabe numa empresa de serviço é curto.

- Quando o preço muda, a página de preço muda no mesmo dia. Sprint a US$ 1.200 que continua no ar como se fosse outro número ensina o modelo a citar o número errado.
- Quando o prazo muda, a frase "2 a 4 semanas" muda. Não se publica um post novo para corrigir uma frase.
- A data visível acompanha a revisão dos fatos, não uma troca cosmética de título.
- Uma página boa, atualizada, vale mais do que doze páginas finas cobrindo o fan-out.

## O que não move citação

O guia de 10 de julho de 2026 tem uma seção de mitos. Quatro itens batem com o que agências ainda vendem [1]. O changelog de 15 de junho de 2026 já tinha acrescentado a nota sobre llms.txt: o arquivo não é necessário para o Google Search e não muda visibilidade nem ranking para cima nem para baixo [2].

| Tática | O que a fonte diz | Nota |
|---|---|---|
| llms.txt | O Google Search não usa. Manter o arquivo não ajuda nem atrapalha no Google [1]. | Estudo de vendor: 97% dos arquivos válidos não receberam nenhum pedido em maio de 2026 [16]. Detalhe no texto sobre [llms.txt](/pt/blog/llms-txt-funciona/). |
| Schema especial de IA | Não é exigido para busca generativa. Não existe markup schema.org especial para isso. Schema segue útil para rich results clássicos [1]. | Vendor, difference-in-differences: 1.885 páginas que ganharam JSON-LD entre agosto de 2025 e março de 2026, contra cerca de 4.000 controles. AI Mode +2,4% e ChatGPT +2,2%, indistinguíveis de zero. AI Overviews menos 4,6%, efeito pequeno. As páginas já eram muito citadas. O teste não fala de quem ainda não é citado [17]. |
| Chunking | Não há requisito de quebrar a página em pedaços minúsculos. O Google diz que entende vários assuntos na mesma página [1]. | No laboratório da SIGIR, formatação sozinha não teve efeito consistente [15]. |
| Menção inautêntica | O guia manda ignorar. A política de spam, desde 15 de maio de 2026, cobre manipular resposta de IA [1] [2] [3]. | Botão "lembre de nós" foi documentado pela Microsoft como envenenamento de memória [19]. |
| Reescrever só para a IA | Não é necessário. Os sistemas entendem sinônimo e intenção [1]. | Página escrita para uma pessoa, com fato verificável, é o que o guia pede. |

O rich result de FAQ do Google entrou em depreciação no changelog de 8 de maio de 2026 [2]. FAQ no corpo da página continua sendo texto. Selo de FAQ na busca clássica não é alavanca de citação.

## O que é spam desde 15 de maio de 2026

A data não criou um tipo novo de penalidade com nome de GEO. Ela tornou explícito que manipular a resposta de IA generativa é spam de Search [2] [3]. Na prática, estes trabalhos passaram a ter nome na política, se o fim principal for manipular:

- rede de sites satélites que se citam
- dezenas de páginas quase iguais, uma por variação de fan-out ou por cidade
- texto escondido com instrução para o modelo
- link exigido em contrato, sem `rel="sponsored"` ou `rel="nofollow"`
- domínio expirado recheado de página comercial sem valor

Detecção é automática e, quando preciso, revisão humana com ação manual. O site pode ranquear pior ou sair dos resultados [3]. "Foi uma agência que publicou" não é defesa escrita na política.

## Como medir sem se enganar

Posição numa resposta de IA não é métrica. Presença, ao longo de muitas execuções, é o que os instrumentos oficiais e o teste de consistência conseguem sustentar.

O Search Console tem relatório de IA generativa com impressões de links em AI Overviews e Modo IA: páginas, países, datas (fuso do Pacífico) e dispositivos. Desde 31 de agosto de 2026 o relatório está disponível para sites do mundo todo, se houver impressões suficientes. Não há, na ajuda aberta, colunas de clique, CTR, posição ou consulta. O dado também entra no relatório de desempenho Web. Somar um em cima do outro conta a mesma impressão duas vezes [11].

O Bing Webmaster Tools mostra citações desde 10 de fevereiro de 2026: total de citações, média de páginas citadas por dia, uma amostra de grounding queries, citações por URL e a série no tempo. O anúncio diz, em mais de um lugar, que isso não indica posição, ranking nem o papel da página dentro de uma resposta [12]. Em 16 de junho de 2026 entraram, em preview global, Intents, Topics, Citation Share e Compare. Citation Share é a porcentagem das citações daquela grounding query que foram para o seu site. A Microsoft escreve que não é ranking, não é fatia de tráfego, não revela o domínio do concorrente e não dá nota de qualidade [13].

O teste de consistência é de Rand Fishkin, na SparkToro, com coletas em novembro e dezembro de 2025. Cerca de 600 voluntários rodaram 12 prompts em ChatGPT, Claude e na IA do Google, 2.961 vezes no total. A chance de a mesma lista de marcas aparecer em duas respostas ficou abaixo de 1 em 100. A mesma lista na mesma ordem ficou perto de 1 em 1.000. O que se repetiu foi o conjunto de marcas que aparece com frequência (a taxa de presença), não a ordem. O coautor do lado de dados trabalha na Gumshoe, uma empresa de tracking de IA. O próprio texto trata posição como métrica sem fundamento e presença percentual, em muitas rodadas, como a medida que sobra [18].

O que não é medida:

- um print de uma conversa
- "ficamos em segundo" numa resposta só
- ferramenta de terceiro que promete métrica interna do Google (o guia diz que nenhuma tem acesso aos sistemas internos) [1]
- somar impressão de IA generativa em cima do desempenho Web [11]

Cadência honesta para uma empresa que já está no Search Console e no Bing: olhar os dois relatórios toda semana, e rodar um conjunto fixo de perguntas reais do cliente muitas vezes por mês, registrando se a marca apareceu. A tendência desse conjunto é o resultado. A oscilação de um dia não é.

## Erros comuns

- Bloquear GPTBot e achar que "saiu do ChatGPT". O interruptor da busca é o OAI-SearchBot [4].
- Liberar o robô no robots.txt e barrar o IP na borda. A OpenAI condiciona a elegibilidade aos dois [5].
- Achar que `Google-Extended` liga o Modo IA [9].
- Publicar vinte cidades sem operação, para "cobrir o fan-out" [1] [3].
- Esconder o preço e esperar que a IA invente um número favorável. No laboratório, ausência de preço foi eliminatória [15].
- Medir um print e chamar de ranking [18].
- Contratar geração de llms.txt como se fosse o programa inteiro [1] [16].

## O que não fazer

Não compre menção. Não monte rede de domínios. Não escreva instrução escondida para o modelo. Não publique uma página por sinônimo. Não reescreva o site "no tom da IA". Não troque conteúdo útil por FAQ marcado só para rich result. Não prometa, e não aceite promessa de, primeiro lugar no ChatGPT.

Se a página verdadeira ainda não existe, o trabalho é escrever uma: serviço, preço, prazo, data, exemplo anonimizado do que já foi entregue. Um SaaS B2B de academias que nasceu no Lovable e hoje roda em produção. Agentes de WhatsApp em produção para clínicas, hotelaria, varejo B2B, um parque, uma administradora de condomínios, uma assessoria de vistos. Isso é material de portão 2. Dez variações do mesmo parágrafo não são.

## Quando não contratar a samambai

Não contrate a samambai se o pedido for qualquer um destes:

- garantia de posição, porcentagem de citação ou "primeiro no ChatGPT em 30 dias"
- rede de sites, menção paga ou botão que pede ao modelo para memorizar a marca
- um arquivo llms.txt, um schema ou um "chunking" como entrega inteira
- gestão de mídia paga (não faz parte do que a samambai vende)
- resultado na semana que vem a partir de um domínio que o Google e o Bing ainda não indexaram, sem página nova e sem disposição de esperar o rastreio

O trabalho cabe quando existe um serviço real, uma página que pode dizer o preço, e paciência para medir presença. A conversa inicial dura 30 minutos, sem compromisso. Os formatos públicos estão em [preços](/pt/precos/): Sprint de US$ 1.200 por duas semanas, com cancelamento quando quiser; projeto a partir de US$ 3.000, com escopo fechado e entrega a cada sprint; parceria a partir de US$ 900 por mês. O serviço de GEO está descrito em [GEO](/pt/geo/). O arquivo llms.txt, e por que ele não é este trabalho, está no [texto específico](/pt/blog/llms-txt-funciona/).

Quem assina o critério é o mesmo de sempre: diagnóstico, estratégia, execução e evolução, em sprints de duas semanas, com revisão humana. Agente de IA entra na construção, no teste e numa auditoria independente. Não entra no lugar de alguém lendo a página antes de publicar.
