Como um achado vira achado
O Tabkeel não dá nota no seu site. Ele emite achados, e um achado só existe quando dá pra provar com um número, um trecho literal ou dois links. Esta página é a regra do jogo, pública de propósito: você pode refazer qualquer conta.
Não reportamos suspeita. Só emitimos achado com evidência que você pode clicar. Se você acha que erramos, o link está aí.
A escala de verificabilidade
Toda saída de um verificador de sites cabe num degrau desta escala. O produto inteiro opera nos degraus 1 e 2. Nunca no 4 ou no 5: "sua UX é confusa" e "sua copy é genérica" não existem aqui, porque não são contestáveis nem prováveis.
| Degrau | Tipo de saída | Contestável? |
|---|---|---|
| 1 | Fato com fonte dupla, ou existência/ausência verificável | não |
| 2 | Medida contra padrão público | só contestando o padrão |
| 3 | Previsão com histórico de acerto publicado | só olhando o histórico |
| 4 | Julgamento por rubrica própria | sempre |
| 5 | Opinião livre | trivialmente |
Regra operacional: se não dá pra mostrar o número, o trecho literal ou os dois links, o achado não sai.
As regras invioláveis
- O LLM localiza, não julga. Onde usamos modelo de linguagem, ele extrai o par afirmação e evidência e redige a correção. O veredito é sempre de código determinístico.
- Se a IA sumisse, o produto sobrevive. Link morto é status HTTP. Preço divergente é comparação de strings. Estado ausente é presença de seletor. A maior parte dos verificadores roda sem nenhum modelo.
- Subnotificar, de propósito. Confiança abaixo do threshold não vira achado: vira uma linha na seção de inconclusivos, separada e rotulada. Melhor 4 achados sólidos que 19 duvidosos.
- Nunca veredito público sobre terceiro. O relatório é entregue a quem colou a URL. Não publicamos página julgando o site de ninguém.
- Severidade vem da consequência, não da gente. Tabela fixa, abaixo. Não existe severidade "a critério".
Severidade: tabela fixa
| Severidade | Critério | Exemplos |
|---|---|---|
| blocker | Dinheiro ou dado | preço divergente do cobrado; cobra sem política de reembolso; formulário que perde submissão em silêncio |
| alta | Trava conversão ou gera disputa | promessa quebrada em página de venda; "cancele quando quiser" negado nos termos; sem tratamento de 404 |
| média | Corrói leitura e confiança | claim que a doc não confirma; site ilegível pra IA; política de privacidade incompleta |
| baixa | Higiene | changelog não refletido; deriva de nomenclatura; título duplicado |
O número é contagem, não nota
O resultado principal de um exame é uma contagem: 3 promessas quebradas, 2 preços divergentes, 4 problemas de leitura por IA. Contagem é verificável; nota de 0 a 100 é opinião com verniz. Quando publicarmos o percentil contra o corpus (seu número comparado à mediana de SaaS construídos com IA), a fórmula de normalização será esta, pública:
score = 100 - min(100, blockers*15 + high*7 + medium*3 + low*1)
Você recalcula na mão. É o objetivo.
O que coletamos de cada exame
Todo exame alimenta um agregado anônimo, que será a base de um relatório publicado e do futuro percentil. O registro anônimo guarda:
- o domínio examinado como hash com chave (HMAC): dá pra contar reincidência, mas sem a nossa chave secreta não dá pra voltar do hash pro domínio — nem nós no agregado, nem quem obtiver o banco;
- contagens: quantas páginas, quantos achados de cada tipo e severidade;
- segmentadores: se o site tem página de preço, página legal e checkout ativo, e quais impressões de stack e de meio de pagamento aparecem;
- quando você roda o espelho de IA: se a IA reconhece e cita o produto, a posição e quantos concorrentes ela nomeia, e um rótulo amplo de categoria (nunca o domínio);
- nada de conteúdo das páginas, nada de URL legível, nada de quem colou.
Com conta, o relatório completo fica salvo no seu histórico: seu e sob row level security. Detalhes na política de privacidade.
Limites conhecidos, por escrito
- Lemos o HTML servido. Ainda não renderizamos JavaScript: aliás, se seu conteúdo só existe com JS, isso é um achado, porque crawler de IA também não renderiza.
- Não testamos formulários nem fluxos logados. Verificador novo só entra quando dá pra manter a taxa de falso positivo perto de zero.
- Subnotificamos. Se o exame diz 4 achados, pode haver mais; não há menos.
- Quando errarmos mesmo assim, o feedback de falso positivo desliga o verificador ruim até consertarmos. A taxa de confirmação será publicada aqui quando a amostra for honesta.