Metodologia: a grelha de pontuação pública
A nossa pontuação não é uma caixa negra. Em baixo encontra as 46 verificações, os seus pesos, os seus níveis de confiança e as fontes públicas em que assentam. Está tudo versionado, por isso, quando uma verificação ou um peso muda, vê exatamente o que mudou e em que versão.
Versão do conjunto de regras: 1.0.0
Dois números, nunca misturados
A pontuação AI-Readiness (de 0 a 100) mede aquilo que controla: a soma ponderada das categorias A a E. Determinista: as mesmas entradas produzem sempre a mesma pontuação.
O índice de visibilidade em direto («mencionado em X de N respostas») mede o resultado. Reportamo-lo em separado, porque misturá-lo com a pontuação penalizaria os sites recentes pela sua antiguidade, e não por defeitos corrigíveis.
Categorias e pesos
A categoria B tem o maior peso. O conteúdo que só aparece depois de o JavaScript ser executado é o defeito grave mais frequente, e o que conseguimos comprovar com maior clareza: colocamos o HTML em bruto ao lado do DOM renderizado e mostramos-lhe exatamente o que desapareceu.
| Categoria | Peso | Natureza |
|---|---|---|
| A Acesso da IA e rastreabilidade | 22 | determinista |
| B Conteúdo legível por máquina (sem JS) | 28 | determinista |
| C Dados estruturados e clareza de entidade | 18 | determinista |
| D Citabilidade e respostas diretas | 22 | avaliado por modelo, segundo uma grelha escrita |
| E Qualidade técnica e acessibilidade | 10 | determinista |
Todas as verificações
A · Acesso da IA e rastreabilidade
| Verificação | Pontos | Âmbito | Confiança | Fonte |
|---|---|---|---|---|
| A1 robots.txt acessível e analisável | 3 | site | comprovado | developers.google.com |
| A2 OAI-SearchBot permitido (citações na pesquisa do ChatGPT) | 3 | site | comprovado | developers.openai.com |
| A3 Política do GPTBot (apenas exposição ao treino) | 1 | site | comprovado | developers.openai.com |
| A4 ClaudeBot e Claude-SearchBot permitidos | 2 | site | comprovado | support.claude.com |
| A5 PerplexityBot permitido | 2 | site | comprovado | docs.perplexity.ai |
| A6 bingbot permitido (fundamentação do Copilot) | 2 | site | comprovado | bing.com |
| A7 Política do Google-Extended (fundamentação/treino do Gemini) | 1 | site | comprovado | developers.google.com |
| A8 Sem diretivas de bloqueio de snippets no conteúdo principal | 2 | página | comprovado | developers.google.com |
| A9 Páginas acessíveis aos user-agents dos bots de IA | 3 | página | comprovado | fonte |
| A10 Sem noindex nas páginas auditadas | 1 | página | comprovado | developers.google.com |
| A11 Sitemap XML presente, válido e fiel | 2 | site | comprovado | sitemaps.org |
| A12 URL canónico correto | 1 | página | comprovado | developers.google.com |
| A13 Cadeias de redirecionamento curtas | 1 | página | comprovado | developers.google.com |
B · Conteúdo legível por máquina (sem JS)
| Verificação | Pontos | Âmbito | Confiança | Fonte |
|---|---|---|---|---|
| B1 Paridade de conteúdo: HTML em bruto vs DOM renderizado | 8 | página | comprovado | vercel.com |
| B2 Texto substancial no HTML em bruto | 3 | página | consenso | developers.google.com |
| B3 Um único H1 e hierarquia de cabeçalhos lógica | 3 | página | comprovado | w3.org |
| B4 Marcos semânticos (main, nav, article) | 2 | página | consenso | w3.org |
| B5 Navegação <a href> rastreável | 3 | página | comprovado | developers.google.com |
| B6 As imagens têm texto alternativo descritivo | 2 | página | comprovado | w3.org |
| B7 Dados como marcação real de tabelas/listas | 2 | página | consenso | w3.org |
| B8 Texto de ligação descritivo | 2 | página | comprovado | w3.org |
| B9 Rácio razoável de texto para marcação | 1 | página | consenso | fonte |
| B10 Sem conteúdo bloqueado por trás de interação | 2 | página | comprovado | developers.google.com |
C · Dados estruturados e clareza de entidade
| Verificação | Pontos | Âmbito | Confiança | Fonte |
|---|---|---|---|---|
| C1 O JSON-LD é analisado sem erros | 3 | página | comprovado | developers.google.com |
| C2 Schema Organization/LocalBusiness com identidade | 3 | site | comprovado | developers.google.com |
| C3 Schema WebSite na página inicial | 2 | site | comprovado | schema.org |
| C4 Schema do tipo de página com as propriedades obrigatórias | 3 | página | comprovado | developers.google.com |
| C5 Os dados estruturados correspondem ao conteúdo visível | 2 | página | comprovado | developers.google.com |
| C6 Coerência do NAP (nome, morada, telefone) | 3 | site | consenso | fonte |
| C7 O atributo html lang corresponde ao idioma do conteúdo | 1 | página | comprovado | w3.org |
| C8 Reciprocidade de hreflang (multilingue) | 1 | site | comprovado | developers.google.com |
D · Citabilidade e respostas diretas
| Verificação | Pontos | Âmbito | Confiança | Fonte |
|---|---|---|---|---|
| D1 Bloco de resposta direta perto do topo | 4 | página | consenso | developers.google.com |
| D2 Cabeçalhos em forma de pergunta | 3 | página | consenso | developers.google.com |
| D3 Especificidades verificáveis em vez de prosa de marketing | 4 | página | correlacionado | arxiv.org |
| D4 Blocos de definição para os termos-chave | 3 | página | consenso | developers.google.com |
| D5 Secções autónomas (compatíveis com RAG) | 3 | página | consenso | developers.google.com |
| D6 Sinais de atualidade | 2 | página | consenso | docs.perplexity.ai |
| D7 Presença de E-E-A-T: autoria e fontes | 3 | página | correlacionado | arxiv.org |
A categoria D é avaliada por um modelo de IA segundo uma grelha escrita e versionada: temperatura 0, com a identidade do modelo e a versão do prompt guardadas em cada auditoria para garantir a reprodutibilidade. Cada critério obtém de 0 a 2 pontos, mais uma citação textual como evidência.
E · Qualidade técnica e acessibilidade
| Verificação | Pontos | Âmbito | Confiança | Fonte |
|---|---|---|---|---|
| E1 HTTPS com redirecionamento HTTP→HTTPS | 2 | site | comprovado | developers.google.com |
| E2 Core Web Vitals (dados de campo) | 4 | site | comprovado | developer.chrome.com |
| E3 Meta viewport para dispositivos móveis | 1 | página | comprovado | developers.google.com |
| E4 Fundamentos de legibilidade por máquina (title, etiquetas) | 2 | página | comprovado | w3.org |
| E5 Sem intersticial de ecrã inteiro no HTML em bruto | 1 | página | comprovado | developers.google.com |
Verificações informativas (0 pontos)
Reportamo-las para dar contexto, mas não afetam a sua pontuação; porque as evidências ainda não sustentam qualquer efeito:
| Verificação | Pontos | Âmbito | Confiança | Fonte |
|---|---|---|---|---|
| A14 Política do CCBot (Common Crawl, informativo) | 0 | site | consenso | commoncrawl.org |
| C9 Tipos de resultados enriquecidos obsoletos (informativo) | 0 | página | comprovado | developers.google.com |
| I1 llms.txt (especulativo) | 0 | site | especulativo | llmstxt.org |
| I2 IndexNow (não detetável externamente) | 0 | site | consenso | indexnow.org |
| I3 Feed RSS/Atom anunciado | 0 | site | consenso | fonte |
| I4 Contexto de CDN/servidor (informativo) | 0 | site | consenso | fonte |
Níveis de confiança
Nem todas as «boas práticas de IA» têm o mesmo fundamento na realidade. Cada verificação declara com honestidade em que assenta:
- COMPROVADO; comportamento oficialmente documentado ou diretamente mensurável (especificações, documentação do fornecedor).
- CORRELACIONADO; sustentado por investigação empírica pública; uma correlação, não uma garantia.
- CONSENSO; prática do setor amplamente aceite, sem medição direta.
- ESPECULATIVO; não comprovado. Vale 0 pontos; reportado apenas a título informativo.
As verificações que não se aplicam (por exemplo, o schema de Product num site sem produtos) são redistribuídas dentro da respetiva categoria; nunca é penalizado por aquilo que não tem.
A metodologia por detrás do nosso trabalho pago
A auditoria acima pontua aquilo que controla. Quando nos contrata para agir sobre ela, através da Implementação ou da Monitorização, o trabalho orienta-se pelo SEO-Kami, a metodologia aberta, com licença MIT, que o nosso fundador mantém. Utiliza os mesmos quatro níveis de confiança que vê acima e a mesma disciplina: manter separado o que está comprovado daquilo que é apenas propaganda.
Ponderamos os sinais de entidade e de earned media
A leitura que o SEO-Kami faz da investigação coloca o earned media em primeiro lugar: menções de marca por toda a web, um nome, morada e telefone coerentes, ligações sameAs e autoria verificável e E-E-A-T. Destaca-se como a alavanca mais potente para a visibilidade perante a IA, muito à frente dos backlinks em bruto, pelo que o nosso trabalho de implementação prioriza esses sinais em conformidade.
Otimizamos para uma realidade sem cliques
A maioria das pesquisas termina agora sem um clique, e as consultas com AI Overview quase sempre. Por isso, tratamos as impressões e a quota de citações pela IA como o verdadeiro resultado, não apenas o tráfego de referência. É pela mesma razão que o seu índice de visibilidade em direto acima é reportado em separado da sua pontuação.
Os números, como contexto, não como promessas
Estas são constatações de nível CORRELACIONADO provenientes de investigação pública: uma correlação, não uma garantia para um site em concreto. As menções de marca na web correlacionam-se em cerca de 0,664 com a visibilidade no AI Overview, contra cerca de 0,218 para os backlinks. Estima-se que 82% das citações pela IA provêm de earned media e não das páginas próprias de uma marca, e que cerca de 83% das consultas de AI Overview terminam sem clique. Usamos estes números para priorizar o trabalho, e dizemos-lhe com honestidade que correções estão comprovadas e quais são especulativas.
O SEO-Kami é de código aberto sob a licença MIT. Ver o SEO-Kami no GitHub