Glossário (SEO, AiSEO, AEO e GEO)
Glossário Técnico de Otimização Semântica e Inteligência Artificial
Para simplificar o entendimento da arquitetura de dados e otimização para indexadores baseados em IA, criamos este dicionário técnico definitivo com tudo o que é auditado pelo Scanit e os fatores determinantes para ranqueamento moderno:
- SEO (Search Engine Optimization): A tradicional otimização para mecanismos de busca baseada em palavras-chave, relevância técnica, indexação estrutural e autoridade de links para ranquear no topo dos resultados clássicos do Google.
- AiSEO (Artificial Intelligence Search Optimization): A nova disciplina de otimização de sites para garantir a legibilidade de dados por modelos de IA (LLMs) e chats de busca inteligentes. Concentra-se em manter diretivas abertas e documentos técnicos legíveis.
- AEO (Answer Engine Optimization): Foco absoluto em estruturar respostas rápidas, diretas e concisas a perguntas feitas por usuários via buscas por voz ou chats de conversação, maximizando a chance do site ser lido em destaque.
- GEO (Generative Engine Optimization): Estratégia avançada que prepara websites para serem as fontes de referência citadas nos resumos inteligentes gerados por IAs (como Gemini e ChatGPT Search). Envolve validação semântica e citação de estatísticas e fontes de autoridade.
- robots.txt: Arquivo de texto localizado na raiz do domínio usado para indicar aos robôs (crawlers) quais seções do site podem ou não ser acessadas. No ecossistema atual, serve para sinalizar permissões para agentes de IA específicos (como GPTBot ou ClaudeBot).
- llms.txt e llms-full.txt: Novos arquivos de contexto propostos pela comunidade técnica. Escritos em Markdown limpo, servem para fornecer descrições diretas do site e de suas APIs de forma simplificada, facilitando o entendimento de contexto para agentes LLM.
- Sitemap.xml: Um mapa estrutural em formato XML que lista todas as páginas relevantes de um site para informar aos rastreadores onde encontrar novos conteúdos com agilidade.
- JSON-LD (JavaScript Object Notation for Linked Data): Padrão de dados estruturados recomendado pelo W3C que serializa entidades e relações de dados semânticos em formato JSON. Ele ajuda IAs a construírem o grafo de entidades do negócio (identificando autores, corporações, FAQs e produtos) sem ambiguidade.
- E-EAT (Experience, Expertise, Authoritativeness, Trustworthiness): Diretrizes de qualidade de conteúdo do Google. Demonstra-se confiança e autoridade na web através de links institucionais visíveis e válidos (como páginas "Sobre", "Termos de Uso", "Política de Privacidade" e adequação à "LGPD").
- RAG (Retrieval-Augmented Generation): Processo em que um modelo de linguagem (LLM) consulta uma base de dados externa em tempo real (como o índice de busca da web contendo o seu site) para gerar respostas precisas e atualizadas ao usuário final.
- GPTBot: Web crawler oficial da OpenAI usado para coletar informações na web e alimentar o ChatGPT e os modelos da família GPT.
- ClaudeBot: O robô de indexação da Anthropic usado para processar conteúdos para alimentar a inteligência artificial Claude.
- Google-Extended: Token de controle do robots.txt que permite a proprietários de sites escolherem se autorizam o uso de seus dados para treinar os modelos de inteligência artificial generativa do Google (como Gemini).
- PerplexityBot: O rastreador inteligente do Perplexity AI que lê páginas da web em tempo real para citar fontes específicas nas respostas diretas geradas aos usuários.
- User-Agent: String de identificação única enviada por cada navegador ou robô de rastreamento para informar ao servidor quem está realizando a requisição técnica.
- Busca Semântica: A tecnologia de busca moderna que tenta entender a intenção por trás de uma busca e as relações de entidades no texto, em vez de se limitar a buscar correspondências textuais de palavras-chave exatas.