Resumo

  • O W3C publicou o WCAG Evaluation Methodology 2.0 como Group Note em 23 de julho de 2026. O Accessibility Guidelines Working Group endossa o texto, mas o W3C e seus Membros não; a metodologia não acrescenta nem substitui requisitos do WCAG.
  • Primeiro, o avaliador seleciona uma amostra estruturada que reflita telas comuns, funções essenciais, tipos de conteúdo, tecnologias e outros casos relevantes. Só então adiciona uma amostra aleatória equivalente a 10% daquela amostra estruturada.
  • O exemplo oficial usa 80 itens estruturados e oito aleatórios, chegando a 88. A seleção não precisa seguir critérios científicos estritos, mas deve poder alcançar todo o escopo do produto, evitar padrões previsíveis e ter o método registrado.
  • Processos completos recebem uma proteção própria: todas as telas do caminho padrão e das ramificações comuns ou críticas entram no conjunto quando um item amostrado participa do processo.
  • Na maioria dos usos, avaliar uma amostra pelo WCAG-EM não basta para declarar o produto inteiro em conformidade com o WCAG. O resultado precisa de um recibo que conecte amostra e decisão, mostrando denominador, escopo, método, responsáveis, data e natureza da declaração.

O número vem depois do desenho da evidência

O WCAG-EM 2.0 organiza o trabalho desde a definição do objeto. É preciso delimitar o produto digital, escolher versão e nível do WCAG e registrar a linha de base de suporte à acessibilidade — navegadores, tecnologias assistivas e outros agentes de usuário que o conteúdo deve suportar. A etapa seguinte explora telas comuns, funções indispensáveis, tipos de conteúdo e tecnologias utilizadas.

Desse mapa nasce a amostra estruturada. Ela não é neutra nem automática. O avaliador escolhe elementos que representem a variedade encontrada; uma única tela pode cobrir layout, função e tecnologia. Produtos antigos, complexos, heterogêneos ou dinâmicos podem exigir conjuntos maiores. Resultados anteriores, conhecimento da equipe e grau de confiança pretendido também influenciam o tamanho.

Portanto, o denominador já contém decisões profissionais quando aparece a regra de 10%. A etapa 3.2 define a quantidade aleatória como 10% da amostra estruturada. Se ela tem 80 itens, selecionam-se mais oito e o total passa a 88.

O total de páginas ou estados do produto não participa dessa conta. Um site com milhares de páginas não foi auditado em 10% só porque oito páginas aleatórias foram acrescentadas a 80 deliberadamente escolhidas. Em aplicações que geram estados em tempo real, pode nem existir uma população estável que permita tal interpretação.

A amostra aleatória testa o mapa do avaliador

Os dois conjuntos cumprem papéis distintos. A amostra estruturada representa o que a exploração conseguiu identificar. A aleatória procura conteúdo e problemas fora desse mapa. Depois da avaliação, o WCAG-EM manda comparar os resultados. Se o conjunto aleatório revelar um tipo de conteúdo ou achado novo, a amostra estruturada não era suficientemente representativa.

Nesse caso, o avaliador volta à exploração, acrescenta novos elementos e repete a comparação. A aleatoriedade funciona como feedback. Não concede uma chancela definitiva à seleção inicial; cria uma oportunidade explícita de corrigi-la.

A Note admite ferramentas de rastreamento, listas, logs de servidor, mecanismos de busca e outros meios práticos. Também afirma que não é necessário seguir critérios estritamente científicos. Mas o universo de seleção deve abranger todo o escopo do produto, as escolhas não podem seguir um padrão previsível e o método deve ser registrado para favorecer confiabilidade e replicabilidade.

Essas condições impedem dois exageros. Ausência de uma inferência estatística formal não torna a checagem inútil. Ao mesmo tempo, o rótulo “aleatório” não permite deduzir uma margem de erro sobre tudo que não foi observado. A autoridade vem da função de detectar omissões, não de uma cobertura populacional implícita.

Um processo não termina na tela que parece melhor

Muitas barreiras surgem entre estados: após o envio de um formulário, na mensagem de erro, no login, no pagamento ou na confirmação. Por isso, a etapa 3.3 exige que todas as páginas ou telas de um processo completo sejam incluídas quando qualquer amostra faz parte dele.

O avaliador localiza o ponto inicial, registra o caminho padrão e inclui ramificações frequentes ou críticas. Também descreve as ações necessárias para avançar, pois uma URL raramente reproduz sozinha dados, configurações, diálogos e estados de interação.

Essa regra não é uma forma de aumentar mecanicamente os 10%. Ela protege uma unidade de experiência. A amostra estruturada cobre diversidade conhecida; a aleatória procura lacunas; a expansão de processo impede que uma tarefa seja cortada em fragmentos convenientes. Resumir as três em uma taxa única apaga o motivo de cada uma existir.

O alcance da conclusão não pode superar o da avaliação

O WCAG-EM diz que uma declaração de conformidade para um site inteiro não pode se apoiar apenas na avaliação de um subconjunto de páginas e funcionalidades. Sempre pode haver falhas ainda não identificadas. Como a maioria dos usos seleciona uma amostra, usar somente a metodologia normalmente não permite declarar todo o produto em conformidade com o WCAG.

Isso não reduz o valor da evidência amostral. Ela pode orientar correções, apoiar uma aquisição, comparar versões e acompanhar risco. A restrição recai sobre a frase final. “As amostras avaliadas atingiram o alvo” não é sinônimo de “o produto está conforme”.

Há uma declaração de avaliação opcional. Para ela, o proprietário precisa cumprir os requisitos metodológicos obrigatórios, obter o alvo em todas as amostras e incluir data, título, versão e URI do WCAG, nível, escopo, tecnologias e base de suporte. Também assume o compromisso de garantir validade e manter precisão.

Esse compromisso exige versão e prazo. Mudanças no design system, na autenticação, no pagamento, no CMS, numa integração externa ou na base de tecnologias assistivas podem tornar uma conclusão antiga. Sem gatilho de reavaliação, o texto parece estável enquanto o objeto avaliado deixa de existir.

Um recibo curto para uma cadeia de prova longa

O relatório obrigatório já preserva muito: avaliador, contratante, data, escopo, alvo, base de suporte, tecnologias, amostras estruturadas e aleatórias, método de seleção, processos completos e resultados. Registros opcionais podem guardar navegadores, ferramentas, tecnologias assistivas, cópias de telas e passos de reprodução. Senhas, código interno e dados pessoais precisam permanecer protegidos.

Não é necessário expor tudo para evitar uma declaração vazia. Um recibo de amostra para decisão pode levar ao ponto de uso os campos indispensáveis. Ele deve nomear produto, versão e escopo; WCAG e nível; base de suporte; tamanho e justificativa da amostra estruturada; número aleatório, denominador e método; processos completos; descobertas exclusivas do conjunto aleatório e iterações posteriores.

O mesmo registro identifica avaliador, contratante e proprietário responsável, data, vencimento ou mudança que exige nova avaliação e tipo de saída: achado interno, declaração de avaliação WCAG-EM ou declaração de conformidade WCAG. Assim, uma área de compras pode verificar a autoridade sem receber credenciais ou anexos confidenciais.

Se houver pontuação agregada, a fórmula e as limitações também precisam viajar. A própria Note afirma que não há uma métrica única conhecida capaz de atender simultaneamente confiabilidade, precisão e praticidade; notas agregadas podem enganar e não explicam a acessibilidade real do produto. O WCAG não fornece um sistema de nota. Um número pode comunicar progresso, mas não substituir os achados.

Na lente de agência de Heng Lu, a confiança se perde quando não é possível distinguir o agente que selecionou a evidência do principal que autorizou a declaração. O recibo não elimina julgamento; ele mostra onde o julgamento ocorreu e até onde seus efeitos foram delegados.

O que as fontes não demonstram

O documento não diz que 10% da amostra estruturada seja uma quantidade suficiente para todos os produtos. O tamanho absoluto depende do contexto. Também não promete representatividade estatística nem intervalo de confiança.

O limite sobre a conformidade do produto inteiro não torna inútil a avaliação por amostra. Ele impede uma mudança silenciosa de escopo. Este Artigo não mede a acessibilidade de produto algum nem acusa qualquer avaliador de distorção. O recibo proposto é uma recomendação de governança de Daniel Kade, não um requisito ou selo do W3C.

Fontes

  1. W3C — anúncio da Group Note WCAG-EM 2.0
  2. W3C — WCAG Evaluation Methodology 2.0, Group Note de 23 de julho de 2026
  3. W3C — histórico de publicação do WCAG-EM 2.0
  4. W3C — tipos de documentos
  5. W3C — Process Document de 18 de agosto de 2025
  6. W3C — Web Content Accessibility Guidelines 2.2
  7. W3C WAI — ferramenta de relatório WCAG-EM
  8. Heng Lu — On the Agency Problem at the Core of Internet Governance