Glossário GEO

GEO, AEO, LLMO, llms.txt, GPTBot, grounding, share of voice. Os termos da optimização para motores de resposta, explicados sem jargão.

GEO
GEO — Generative Engine Optimization — é o trabalho de tornar uma marca citável pelos motores de resposta de IA, como o ChatGPT, o Perplexity e o Gemini.
Difere do SEO no objecto: o SEO disputa dez ligações numa página de resultados, o GEO disputa três nomes dentro de uma resposta escrita. Não há posição média nem CTR — ou a marca é nomeada, ou não existe naquela resposta.
AEO
AEO — Answer Engine Optimization — é o mesmo trabalho que o GEO, num nome que insiste no que mudou: o utilizador recebe uma resposta, não uma lista.
LLMO
LLMO — Large Language Model Optimization — é a variante do termo que põe a ênfase no modelo em vez do motor, e usa-se sobretudo quando se fala de treino e não de pesquisa.
llms.txt
O `llms.txt` é um ficheiro na raiz de um site que resume, em texto simples, o que o site é e onde está o conteúdo que interessa a um modelo de linguagem.
Não é um padrão obrigatório e nenhum motor o exige. É barato de fazer e, quando existe e está bem estruturado, poupa ao modelo o trabalho de adivinhar a partir da navegação.
GPTBot
O GPTBot é o rastreador da OpenAI que recolhe conteúdo para treino dos modelos. Bloqueá-lo no `robots.txt` impede que o site alimente versões futuras do ChatGPT.
Não confundir com o `OAI-SearchBot` e o `ChatGPT-User`, que servem a pesquisa em tempo real. Bloquear os últimos é o que tira a marca das respostas de hoje; bloquear o GPTBot afecta o que o modelo sabe amanhã.
Grounding
Grounding é a pesquisa que um modelo faz na web antes de responder, para sustentar a resposta em fontes actuais em vez de na memória do treino.
É o que torna a medição possível e o que a torna cara: cada pesquisa é cobrada à parte pelos fornecedores, e um pedido pode disparar várias.
Share of voice
Share of voice, em visibilidade de IA, é a fatia das respostas de um conjunto de perguntas em que uma marca é nomeada, comparada com os concorrentes.
robots.txt
O `robots.txt` é o ficheiro que diz a cada rastreador o que pode ou não visitar. É o primeiro sítio onde se descobre porque é que uma marca nunca aparece nas respostas.
Um `Disallow: /` dirigido a `User-agent: *` bloqueia também os rastreadores de IA — e é normalmente herdado de um ambiente de testes que ninguém voltou a rever.
Dados estruturados
Dados estruturados são marcações em JSON-LD que dizem a uma máquina o que a página é — uma empresa, um serviço, uma pergunta com resposta — em vez de a obrigar a deduzir do texto.
`Organization` e `LocalBusiness` identificam a entidade; `FAQPage` é o formato que os modelos mais extraem, porque já vem no formato de pergunta e resposta que eles produzem.
Citação e menção
Uma menção é o nome da marca aparecer no texto da resposta; uma citação é o motor apontar para o site como fonte. Pode haver menção sem citação, e citação sem tráfego.