Documento técnico · uso interno
araneuron — Teste de Esforço Cognitivo por meio da Leitura
O que é: um índice-resumo que combina, num único número, o acoplamento, as regressões presas, as fixações prolongadas e o excesso de custo.
Por que importa: dá uma leitura rápida do padrão geral de leitura em uma só medida.
Escore composto ilustrativo: pesos e cortes não validados. Use como triagem, nunca como resultado isolado.
O que é: o quanto o tempo de fixação acompanha a surpresa (entropia) de cada palavra.
Por que importa: no cérebro íntegro, o custo escala com a surpresa real (codificação preditiva). Custo que não acompanha a previsibilidade indica desacoplamento — o sinal central de interesse.
Depende da precisão da webcam e do número de palavras com fixação; com poucos dados, o r fica instável.
O que é: quantos milissegundos de fixação a mais o leitor gasta por cada bit de surpresa.
Por que importa: mede a eficiência da predição. Inclinação positiva é esperada; muito baixa/nula sugere que a leitura não está sendo modulada pela previsibilidade.
A escala absoluta varia entre pessoas; interprete junto do acoplamento, não isolado.
O que é: o tempo médio de fixação nas palavras previsíveis (baixa entropia).
Por que importa: é o sinal mais específico — gastar muito tempo numa palavra óbvia é falha pura de antecipação semântica.
O valor absoluto depende da idade e da velocidade basal de leitura; o mais informativo é comparar o mesmo paciente ao longo do tempo.
O que é: separa as regressões presas (fixação longa, olhar "vidrado") das estratégicas (rápidas, de confirmação).
Por que importa: distingue a desorganização patológica (Doente) da desconfiança metacognitiva normal (Detetive) — evita confundir um leitor cuidadoso com um leitor em declínio.
O limiar que separa "estratégica" de "presa" (≈ 280 ms) é heurístico e será calibrado na Fase 2.
O que é: número de fixações muito longas — o olhar "preso" numa mesma palavra.
Por que importa: indica custo de processamento desproporcional.
Uma palavra de surpresa muito alta pode gerar uma fixação longa legítima. Sensível ao limiar (500 ms) e à taxa de amostragem da câmera.
O que é: quanto o esforço total de leitura superou o de um leitor de referência (curva azul do gráfico), calculado a partir da entropia.
Por que importa: é o "descolamento" global entre o esperado e o observado.
A curva de referência usa constantes provisórias (placeholder) até existirem normas por idade e escolaridade — previstas para a Fase 2.
O que é: o custo extra observado nas palavras semanticamente inesperadas (as frases-armadilha).
Por que importa: é o correlato comportamental do N400 — o sinal de erro de predição semântica. Espera-se um pico pontual e bem definido, com retomada da leitura.
É um proxy comportamental. A validação fisiológica real (que "o olho parou porque o cérebro disparou o N400") é feita com EEG na Fase 2.
O que é: quantas leituras de posição do olhar a câmera captou durante a leitura.
Por que importa: é o "controle de qualidade" da coleta. Se for baixo (próximo de 0), nenhuma outra métrica é confiável — provavelmente o rosto saiu do quadro, a luz estava ruim ou a câmera não estava captando.
Antes de interpretar qualquer número, confirme que houve captação suficiente e um número razoável de palavras com fixação.
O que é: quantas palavras receberam ao menos uma fixação analisável.
Por que importa: se for muito baixo, o mapeamento olhar→palavra falhou (calibração ruim ou câmera imprecisa) e a análise não deve ser considerada.
Se este número for baixo com muitas amostras de olhar, o problema é de calibração/mapeamento; se ambos forem baixos, é de captação.