Metodologia: a grelha de pontuação pública

A nossa pontuação não é uma caixa negra. Em baixo encontra as 46 verificações, os seus pesos, os seus níveis de confiança e as fontes públicas em que assentam. Está tudo versionado, por isso, quando uma verificação ou um peso muda, vê exatamente o que mudou e em que versão.

Versão do conjunto de regras: 1.0.0

Dois números, nunca misturados

A pontuação AI-Readiness (de 0 a 100) mede aquilo que controla: a soma ponderada das categorias A a E. Determinista: as mesmas entradas produzem sempre a mesma pontuação.

O índice de visibilidade em direto («mencionado em X de N respostas») mede o resultado. Reportamo-lo em separado, porque misturá-lo com a pontuação penalizaria os sites recentes pela sua antiguidade, e não por defeitos corrigíveis.

Categorias e pesos

A categoria B tem o maior peso. O conteúdo que só aparece depois de o JavaScript ser executado é o defeito grave mais frequente, e o que conseguimos comprovar com maior clareza: colocamos o HTML em bruto ao lado do DOM renderizado e mostramos-lhe exatamente o que desapareceu.

CategoriaPesoNatureza
A Acesso da IA e rastreabilidade22determinista
B Conteúdo legível por máquina (sem JS)28determinista
C Dados estruturados e clareza de entidade18determinista
D Citabilidade e respostas diretas22avaliado por modelo, segundo uma grelha escrita
E Qualidade técnica e acessibilidade10determinista

Todas as verificações

A · Acesso da IA e rastreabilidade

VerificaçãoPontosÂmbitoConfiançaFonte
A1 robots.txt acessível e analisável3sitecomprovadodevelopers.google.com
A2 OAI-SearchBot permitido (citações na pesquisa do ChatGPT)3sitecomprovadodevelopers.openai.com
A3 Política do GPTBot (apenas exposição ao treino)1sitecomprovadodevelopers.openai.com
A4 ClaudeBot e Claude-SearchBot permitidos2sitecomprovadosupport.claude.com
A5 PerplexityBot permitido2sitecomprovadodocs.perplexity.ai
A6 bingbot permitido (fundamentação do Copilot)2sitecomprovadobing.com
A7 Política do Google-Extended (fundamentação/treino do Gemini)1sitecomprovadodevelopers.google.com
A8 Sem diretivas de bloqueio de snippets no conteúdo principal2páginacomprovadodevelopers.google.com
A9 Páginas acessíveis aos user-agents dos bots de IA3páginacomprovadofonte
A10 Sem noindex nas páginas auditadas1páginacomprovadodevelopers.google.com
A11 Sitemap XML presente, válido e fiel2sitecomprovadositemaps.org
A12 URL canónico correto1páginacomprovadodevelopers.google.com
A13 Cadeias de redirecionamento curtas1páginacomprovadodevelopers.google.com

B · Conteúdo legível por máquina (sem JS)

VerificaçãoPontosÂmbitoConfiançaFonte
B1 Paridade de conteúdo: HTML em bruto vs DOM renderizado8páginacomprovadovercel.com
B2 Texto substancial no HTML em bruto3páginaconsensodevelopers.google.com
B3 Um único H1 e hierarquia de cabeçalhos lógica3páginacomprovadow3.org
B4 Marcos semânticos (main, nav, article)2páginaconsensow3.org
B5 Navegação <a href> rastreável3páginacomprovadodevelopers.google.com
B6 As imagens têm texto alternativo descritivo2páginacomprovadow3.org
B7 Dados como marcação real de tabelas/listas2páginaconsensow3.org
B8 Texto de ligação descritivo2páginacomprovadow3.org
B9 Rácio razoável de texto para marcação1páginaconsensofonte
B10 Sem conteúdo bloqueado por trás de interação2páginacomprovadodevelopers.google.com

C · Dados estruturados e clareza de entidade

VerificaçãoPontosÂmbitoConfiançaFonte
C1 O JSON-LD é analisado sem erros3páginacomprovadodevelopers.google.com
C2 Schema Organization/LocalBusiness com identidade3sitecomprovadodevelopers.google.com
C3 Schema WebSite na página inicial2sitecomprovadoschema.org
C4 Schema do tipo de página com as propriedades obrigatórias3páginacomprovadodevelopers.google.com
C5 Os dados estruturados correspondem ao conteúdo visível2páginacomprovadodevelopers.google.com
C6 Coerência do NAP (nome, morada, telefone)3siteconsensofonte
C7 O atributo html lang corresponde ao idioma do conteúdo1páginacomprovadow3.org
C8 Reciprocidade de hreflang (multilingue)1sitecomprovadodevelopers.google.com

D · Citabilidade e respostas diretas

VerificaçãoPontosÂmbitoConfiançaFonte
D1 Bloco de resposta direta perto do topo4páginaconsensodevelopers.google.com
D2 Cabeçalhos em forma de pergunta3páginaconsensodevelopers.google.com
D3 Especificidades verificáveis em vez de prosa de marketing4páginacorrelacionadoarxiv.org
D4 Blocos de definição para os termos-chave3páginaconsensodevelopers.google.com
D5 Secções autónomas (compatíveis com RAG)3páginaconsensodevelopers.google.com
D6 Sinais de atualidade2páginaconsensodocs.perplexity.ai
D7 Presença de E-E-A-T: autoria e fontes3páginacorrelacionadoarxiv.org

A categoria D é avaliada por um modelo de IA segundo uma grelha escrita e versionada: temperatura 0, com a identidade do modelo e a versão do prompt guardadas em cada auditoria para garantir a reprodutibilidade. Cada critério obtém de 0 a 2 pontos, mais uma citação textual como evidência.

E · Qualidade técnica e acessibilidade

VerificaçãoPontosÂmbitoConfiançaFonte
E1 HTTPS com redirecionamento HTTP→HTTPS2sitecomprovadodevelopers.google.com
E2 Core Web Vitals (dados de campo)4sitecomprovadodeveloper.chrome.com
E3 Meta viewport para dispositivos móveis1páginacomprovadodevelopers.google.com
E4 Fundamentos de legibilidade por máquina (title, etiquetas)2páginacomprovadow3.org
E5 Sem intersticial de ecrã inteiro no HTML em bruto1páginacomprovadodevelopers.google.com

Verificações informativas (0 pontos)

Reportamo-las para dar contexto, mas não afetam a sua pontuação; porque as evidências ainda não sustentam qualquer efeito:

VerificaçãoPontosÂmbitoConfiançaFonte
A14 Política do CCBot (Common Crawl, informativo)0siteconsensocommoncrawl.org
C9 Tipos de resultados enriquecidos obsoletos (informativo)0páginacomprovadodevelopers.google.com
I1 llms.txt (especulativo)0siteespeculativollmstxt.org
I2 IndexNow (não detetável externamente)0siteconsensoindexnow.org
I3 Feed RSS/Atom anunciado0siteconsensofonte
I4 Contexto de CDN/servidor (informativo)0siteconsensofonte

Níveis de confiança

Nem todas as «boas práticas de IA» têm o mesmo fundamento na realidade. Cada verificação declara com honestidade em que assenta:

  • COMPROVADO; comportamento oficialmente documentado ou diretamente mensurável (especificações, documentação do fornecedor).
  • CORRELACIONADO; sustentado por investigação empírica pública; uma correlação, não uma garantia.
  • CONSENSO; prática do setor amplamente aceite, sem medição direta.
  • ESPECULATIVO; não comprovado. Vale 0 pontos; reportado apenas a título informativo.

As verificações que não se aplicam (por exemplo, o schema de Product num site sem produtos) são redistribuídas dentro da respetiva categoria; nunca é penalizado por aquilo que não tem.

A metodologia por detrás do nosso trabalho pago

A auditoria acima pontua aquilo que controla. Quando nos contrata para agir sobre ela, através da Implementação ou da Monitorização, o trabalho orienta-se pelo SEO-Kami, a metodologia aberta, com licença MIT, que o nosso fundador mantém. Utiliza os mesmos quatro níveis de confiança que vê acima e a mesma disciplina: manter separado o que está comprovado daquilo que é apenas propaganda.

Ponderamos os sinais de entidade e de earned media

A leitura que o SEO-Kami faz da investigação coloca o earned media em primeiro lugar: menções de marca por toda a web, um nome, morada e telefone coerentes, ligações sameAs e autoria verificável e E-E-A-T. Destaca-se como a alavanca mais potente para a visibilidade perante a IA, muito à frente dos backlinks em bruto, pelo que o nosso trabalho de implementação prioriza esses sinais em conformidade.

Otimizamos para uma realidade sem cliques

A maioria das pesquisas termina agora sem um clique, e as consultas com AI Overview quase sempre. Por isso, tratamos as impressões e a quota de citações pela IA como o verdadeiro resultado, não apenas o tráfego de referência. É pela mesma razão que o seu índice de visibilidade em direto acima é reportado em separado da sua pontuação.

Os números, como contexto, não como promessas

Estas são constatações de nível CORRELACIONADO provenientes de investigação pública: uma correlação, não uma garantia para um site em concreto. As menções de marca na web correlacionam-se em cerca de 0,664 com a visibilidade no AI Overview, contra cerca de 0,218 para os backlinks. Estima-se que 82% das citações pela IA provêm de earned media e não das páginas próprias de uma marca, e que cerca de 83% das consultas de AI Overview terminam sem clique. Usamos estes números para priorizar o trabalho, e dizemos-lhe com honestidade que correções estão comprovadas e quais são especulativas.

O SEO-Kami é de código aberto sob a licença MIT. Ver o SEO-Kami no GitHub

Metodologia: a grelha de pontuação pública · AI-SEO-Radar