Metodologia do Índice Notado
O Índice mede a preparação do site de um negócio para ser lido e citado pela IA. Não mede quantas vezes a IA o recomendou.
O que se mede
Cada site passa pelo mesmo diagnóstico automático: se os robôs de IA conseguem entrar (robots.txt), se o site diz à IA quem é e onde está (dados estruturados, morada, contactos), e se o conteúdo é legível sem depender de JavaScript. Dessas verificações sai um score de 0 a 100.
Um segmento é um par de vertical e cidade. O score de cada negócio é o do seu diagnóstico mais recente que não falhou. Um segmento só é publicado com 4 ou mais sites verificados; abaixo disso a linha existe no CSV com o número de sites e as restantes colunas vazias.
As colunas de CMS do CSV têm outro denominador. A coluna n_sites conta só os negócios com score; as colunas cms_top e cms_top_share contam todos os negócios do segmento, verificados ou não, e por isso assentam num denominador maior. Os negócios cujo CMS não foi identificado ficam fora dessa percentagem e nunca aparecem como CMS dominante.
O que não se mede
O score não diz nada sobre a qualidade do serviço do negócio. Um excelente profissional pode ter score baixo porque o site barra os robôs de IA à entrada.
O score também não é taxa de citação. Saber se o Perplexity, o ChatGPT e as AI Overviews nomeiam um negócio é outra medição, feita por pergunta, motor e repetição, e vive nas páginas de visibilidade. No CSV, as colunas de IA só têm valores nos segmentos onde essa medição já correu; nos outros ficam vazias, e vazio quer dizer não sondado; nunca aparece como zero.
Ler um site e citar um site também são coisas diferentes. Um motor pode ler o site e não o nomear, e isso é um problema de conteúdo; nunca ter lido o site é um problema de indexação, e a correção é outra.
Como a amostra foi recolhida
A lista de negócios veio de 92 ficheiros CSV curados à mão, um por vertical e cidade, com três campos: nome, endereço do site e, às vezes, freguesia. Foram importados de uma só vez a 17 de Agosto de 2026. A categoria de cada negócio é fixada no primeiro import e nunca é reescrita.
A cada negócio importado corre o mesmo diagnóstico automático. Os negócios com origem de demonstração ficam fora de tudo o que é público.
Os limites desta amostra
Esta amostra não é aleatória. É uma lista de conveniência, e os números abaixo dizem onde isso pesa.
- A curadoria não registou como cada negócio foi encontrado. Ninguém pode hoje afirmar que a amostra cobre líderes, medianos e novos entrantes na mesma proporção.
- Dos 643 negócios importados, 41 nunca produziram um score: 22 nunca tiveram diagnóstico a correr e 19 só têm diagnósticos falhados. Esses 41 estão fora de todos os denominadores desta página.
- As sub-verticais misturam-se. Entre clínicas de implantes e clínicas dentárias há 58% de sobreposição de domínios, porque a categoria depende da ordem de import e não da especialidade real do negócio.
- Cadeias com várias moradas entram numa cidade só, a do primeiro import.
- A amostra não cobre obras nem construção civil: são zero negócios.
- Os scores altos e a cauda curta de sites fracos sugerem enviesamento para negócios já com alguma maturidade técnica. É um indício.
A auditoria completa a esta amostra está no repositório do projecto, datada de 4 de Setembro de 2026.
Nomes e a lei
Nenhum ranking público do Índice nomeia um prestador de saúde. O regime da publicidade em saúde (DL 238/2015 e Regulamento 1058/2016, ERS) proíbe o ranking público nomeado de prestadores, com coimas até €44.891,81. Nas verticais de saúde as linhas saem com um rótulo anónimo e sem domínio.
O CSV de cada edição regista essa decisão linha a linha, na coluna nomes_publicados, com a razão sempre que os nomes não são publicados.
Edições
Primeira edição por publicar