Por que o número principal do seu teste não é a velocidade da pessoa, e sim o quanto ela paga a mais por cada bit de dificuldade.
Porque “custo de leitura” quer dizer duas coisas diferentes, e só uma delas serve.
O custo total é quanto a pessoa gasta para ler, no geral. No seu teste por toque, 671 ms por palavra. Esse número está contaminado por tudo: idade, dedo, vista, escolaridade, cansaço, remédio, café. Ele mede o quanto a pessoa é lenta. E ser lento não é sinal de nada em especial — toda condição do mundo deixa alguém mais lento.
O custo da dificuldade é quanto ela gasta a mais quando o texto aperta. Isso é a inclinação.
A sua hipótese não é “quem tem comprometimento lê devagar”. Isso seria verdadeiro e inútil. A sua hipótese vem da codificação preditiva: o cérebro prevê o que vem, e o custo aparece quando a previsão falha. Ou seja, quem prevê bem economiza no fácil. É esse desconto que você está medindo.
Inclinação alta: a pessoa paga barato na palavra óbvia e caro na palavra impossível. A máquina de prever está entregando desconto.
Inclinação baixa: ela paga o mesmo em tudo. Não há desconto. A previsão não está entregando nada.
Você chamou de teste de esforço cognitivo. Pense no teste de esforço cardíaco.
Ninguém diagnostica ninguém pela frequência cardíaca em repouso. Põe-se a pessoa na esteira e aumenta-se a carga em degraus, para ver como o coração responde a cada degrau. O que interessa é a resposta à carga, não o valor parado.
No seu teste, a surpresa em bits é a inclinação da esteira. Cada palavra é um degrau de carga, e você sabe o tamanho exato de cada degrau porque calculou antes de a pessoa chegar. A inclinação é a resposta do sistema à carga.
Sem dividir pela carga, você mede quanto a pessoa andou. Dividindo, você mede o motor.
Esta é a pergunta que alguém vai fazer, e ela tem uma resposta curta: porque a relação entre previsibilidade e tempo de leitura é linear nos bits — e só por isso uma reta a resume.
Hale (2001) e Levy (2008) propuseram a teoria do surprisal: o custo de processar uma palavra é proporcional a −log P(palavra|contexto). Não à probabilidade, ao logaritmo dela. É uma previsão teórica, saída da codificação preditiva.
Smith & Levy (2013) testaram isso em corpora grandes de leitura — rastreamento ocular e leitura autocadenciada. O tempo cresce como função linear do surprisal, e continua linear por cerca de seis ordens de grandeza de probabilidade.
O parágrafo acima apresenta a linearidade como assunto resolvido. Ela não está. Há trabalho publicado dos dois lados, e um psicolinguista experiente vai saber disso.
Contra. Brothers & Kuperberg (2021), no Journal of Memory and Language, testaram a questão em dois experimentos e uma meta-análise. Nos três, a relação entre previsibilidade e tempo foi linear na probabilidade cloze, e não logarítmica. Isso contradiz a teoria do surprisal — e, com ela, a própria unidade ms por bit.
A favor. Shain, Meister, Pimentel, Cotterell & Levy (2024), na PNAS, sustentam o efeito logarítmico em corpora grandes de leitura — equivalente a dizer linear no surprisal, que é a premissa usada aqui.
O que responder, se perguntarem. Que a questão está aberta, citando os dois lados pelo nome. E que o instrumento não cai se a hipótese concorrente vencer: a inclinação continua medindo o quanto o tempo de leitura da pessoa responde à previsibilidade, que é o que interessa clinicamente. O que mudaria é a unidade em que se escreve o resultado — ms por bit passaria a ms por unidade de probabilidade cloze — e, com isso, a escala do número. A comparação entre pessoas, e da mesma pessoa em dias diferentes, sobrevive intacta às duas hipóteses.
Como o estudo vai coletar norma humana por completamento em paralelo — a página complete a frase — ele produz justamente o dado que permite comparar as duas formas na mesma amostra. Vale dizer isso: transforma uma fragilidade em contribuição.
É essa a licença para usar um número só. Se a relação fosse curva, uma pessoa não caberia numa inclinação — seria preciso reportar a curva inteira. Como é reta, ela tem exatamente dois parâmetros: onde começa e quanto sobe. A inclinação é o segundo.
Ser lento desloca a reta inteira para cima. Idade, escolaridade, vista cansada, dedo devagar, celular ruim, sono, remédio — tudo isso atrasa a palavra fácil e a difícil na mesma medida. Mexe no ponto de partida, não no ângulo.
A inclinação é um contraste dentro da própria pessoa: cada um é o seu próprio controle. Ela pergunta apenas o quanto a mais custou a surpresa — e essa pergunta não tem unidade de velocidade, tem unidade de sensibilidade à informação.
Você viu isso no seu próprio caso, do avesso: o teste por voz derrubou a inclinação de 13 para 2 ms/bit na mesma pessoa, no mesmo dia, com as mesmas frases. Não foi lentidão. Foi a tarefa não exigir integração do contexto.
Kutas & Hillyard (1984) mostraram que a amplitude do N400 varia com a previsibilidade da palavra — quanto menos esperada, maior a onda. É a mesma função, medida em microvolts em vez de milissegundos. A inclinação é o análogo comportamental de um efeito que a eletrofisiologia descreve há quarenta anos, e que no comprometimento cognitivo leve aparece reduzido e atrasado.
Que a inclinação é marcador validado de comprometimento cognitivo leve. Isso é a hipótese, não é achado da literatura. O que está estabelecido é a linearidade e o mecanismo. O passo novo — usar a inclinação como medida individual de rastreio — é deste trabalho, e é justamente o que o estudo tem de demonstrar.
Dizer isso em voz alta é o que separa pesquisador de vendedor, e some com a objeção antes que ela seja feita.
Uma segunda ressalva, do mesmo tipo: os valores absolutos de ms/bit publicados variam bastante conforme a tarefa e o material, então não cite número da literatura como se fosse norma. Os 13 ms/bit desta sessão vieram de material construído com contraste extremo, que amplifica o efeito de propósito.
Hale, J. (2001). A probabilistic Earley parser as a psycholinguistic model. NAACL.
Levy, R. (2008). Expectation-based syntactic comprehension. Cognition, 106(3), 1126–1177.
Smith, N. J., & Levy, R. (2013). The effect of word predictability on reading time is logarithmic. Cognition, 128(3), 302–319.
Kutas, M., & Hillyard, S. A. (1984). Brain potentials during reading reflect word expectancy and semantic association. Nature, 307, 161–163.
Cada palavra que a pessoa lê vira um ponto num gráfico. No eixo de baixo, o quanto aquela palavra era surpreendente, em bits. No eixo de lado, quanto tempo ela gastou ali.
Passa-se uma reta pelo meio da nuvem de pontos. Essa reta tem duas partes, e elas dizem coisas diferentes:
A base é onde a reta começa: o que a pessoa gasta mesmo numa palavra sem nenhuma dificuldade. É aqui que mora a lentidão dela.
A inclinação é o quanto a reta sobe. E a conta é só uma divisão:
Por que dividir importa. Se você olhasse só a diferença de tempo entre duas palavras, o número dependeria de quais duas palavras você escolheu. Duas palavras separadas por 5 bits dão uma diferença pequena; separadas por 30, uma diferença grande — e a pessoa é a mesma.
Dividindo pela distância, o número passa a ser da pessoa, e não do par de palavras que você pegou. É a diferença entre o valor da conta e o preço por quilo.
Esta é a parte que fecha o sentido de tudo. A inclinação não é um número neutro: ela tem uma direção clínica esperada.
Inclinação alta. A pessoa gasta pouco na palavra óbvia e muito na palavra impossível. Ela diferencia o fácil do difícil. A máquina de prever está entregando desconto — padrão de predição preservada.
Inclinação baixa. A pessoa gasta quase o mesmo nas duas. Ela não diferencia. Não há desconto no previsível — e é este o padrão que a sua tese suspeita de comprometimento.
Porque é exatamente o que o eletroencefalograma já mostra há décadas. No comprometimento cognitivo leve e no Alzheimer, o N400 vem menor e atrasado: a diferença de resposta entre a palavra esperada e a inesperada encolhe. O cérebro deixa de separar bem uma coisa da outra.
Inclinação plana é esse mesmo fenômeno, medido pelo relógio em vez do eletrodo. Onde o EEG vê a onda deixar de diferenciar, você vê o tempo deixar de diferenciar.
Isso vale para o efeito de repetição também. Em Olichney (2008), o que previu conversão para demência foi a redução do efeito de repetição — a segunda apresentação deixando de custar menos. Mesma lógica: menos diferenciação entre o novo e o já visto.
Envelhecer sozinho não deixa a inclinação plana. Vai na direção contrária.
Schuckart e colegas (2026), na eLife, mediram leitura palavra a palavra com surpresa calculada por modelo de linguagem em 175 pessoas de 18 a 85 anos, com replicação em outras 96. O efeito de previsibilidade aumenta com a idade: o idoso saudável se apoia mais na previsão que o jovem, não menos. O que derruba o efeito não é a idade — é a falta de recurso executivo.
Isso tem três consequências práticas, e todas importam:
Não há faixa de corte publicada. Ninguém pode dizer hoje que abaixo de tantos ms/bit é suspeito. Sensibilidade e especificidade são exatamente o que a sua coleta vai produzir — é para isso que ela existe.
Se alguém pedir um número na reunião, a resposta certa é: “ainda não tenho, e é o que vou medir”. Inventar uma faixa é o jeito mais rápido de perder a sala.
Antes de suspeitar de qualquer pessoa, cinco coisas precisam ser descartadas — e você já viveu duas delas hoje:
Por isso a inclinação nunca se lê sozinha. Ela se lê junto da correlação, do número de palavras e do gráfico — que é o assunto da seção seguinte.
Esta é a razão mais concreta de tudo. Dois leitores com exatamente a mesma média podem ser opostos:
O leitor A gasta pouco nas palavras fáceis e muito nas difíceis. O leitor B gasta o mesmo em todas. A média não distingue os dois — e a diferença entre eles é justamente o que você quer medir.
Por isso a velocidade aparece no seu painel como contexto, e nunca como resultado.
Esta é a resposta para a objeção que você vai ouvir na reunião: “mas idoso é mais lento em tudo”.
Ser lento empurra todos os pontos para cima, juntos. A reta sobe inteira — mas o ângulo dela não muda:
A lentidão vai toda para a base. A inclinação não sente. Por isso cada pessoa acaba sendo o próprio controle: o que é dela fica no começo da reta, e o que você compara é a subida.
E o seu teste ainda faz mais que isso. Antes de qualquer frase, ele mede o tempo de reação puro — a pessoa diz “pá” quando um sinal aparece, sem palavra nenhuma. Isso dá uma estimativa direta da base motora, que é descontada. A inclinação já não dependia dela; o desconto serve para o número de latência absoluta também fazer sentido.
Aqui mora a confusão mais comum, e ela custa caro numa banca. São duas perguntas independentes sobre a mesma nuvem de pontos:
As quatro combinações existem de verdade:
| Inclinação | Correlação | Como ler |
|---|---|---|
| alta | alta | Predição preservada e medida confiável. É o padrão esperado de quem está bem. |
| alta | baixa | O efeito existe, mas a coleta ficou bagunçada. Antes de interpretar: conferir ruído, palavras perdidas e pontos fora da curva. |
| baixa | alta | A pessoa responde de forma consistente — e responde pouco. Paga o mesmo no fácil e no difícil. É este o padrão de interesse clínico. |
| baixa | baixa | Não dá para concluir nada. Ou a coleta falhou, ou a pessoa não estava lendo. Repetir. |
Repare no canto de cima à direita: a inclinação é grande, mas os pontos estão espalhados. E no canto de baixo à esquerda: os pontos estão perfeitamente arrumados, só que a reta quase não sobe. Uma das duas sozinha te engana. É por isso que o painel do seu app mostra as duas lado a lado.
Ruído é erro de medida sem direção: às vezes marca a mais, às vezes a menos, sem preferência.
Os empurrões para cima cancelam os para baixo. A reta continua no mesmo ângulo. O que muda é a distância dos pontos até ela — e é isso que derruba a correlação.
Ruído embaça a nuvem. Ruído não deita a reta.
Guarde essa frase, porque foi ela que resolveu o seu caso.
Você fez os dois testes no mesmo dia, com as mesmas frases:
| Voz | Toque | |
|---|---|---|
| Correlação | 0,15 | 0,50 |
| Inclinação | 2 ms/bit | 13 ms/bit |
| Palavra-alvo * | +101 ms | +277 ms |
| Velocidade | 763 ms | 671 ms |
* Esses dois números vieram de um cálculo que depois se mostrou errado. A palavra-alvo estava sendo comparada com as palavras do meio das mesmas frases — e a última palavra de qualquer frase já custa mais só por ser a última, porque é nela que se amarra o sentido do todo. Os valores estão, portanto, inflados pelo fechamento de frase.
A conta correta compara alvo com alvo: palavra final da frase absurda contra palavra final da frase normal. Como as duas são finais, o fechamento aparece nos dois lados e se cancela. Num teste posterior, os mesmos dados separados deram +149 ms de incongruência e +383 ms de fechamento — dois efeitos que antes vinham somados num número só. Ver as contas, com dois idosos.
A comparação entre voz e toque, que é o assunto desta seção, não muda: a correlação e a inclinação não dependem desse cálculo.
Se a versão por voz fosse apenas menos precisa, a correlação teria caído e a inclinação teria ficado nos 13 — porque ruído não deita a reta. Mas a inclinação caiu para 2. A reta deitou.
Reta deitada não é névoa. É efeito que encolheu de verdade. Foi esse raciocínio que apontou a tarefa como culpada, e não o aparelho — e é por isso que o toque continua sendo o instrumento principal.
Ela não é infalível. Quatro coisas a distorcem, e todas têm conserto:
Esta página foi escrita quando o instrumento tinha duas medidas: a inclinação e o custo na palavra-alvo. Hoje são três.
A terceira é o fechamento de frase: quanto a última palavra custa a mais que as do meio, contando só as frases normais. É o tempo de amarrar o sentido do todo, e ele não tem nada a ver com estranheza — aparece mesmo quando a palavra final é a esperada.
Ele entrou por dois motivos. Primeiro, porque era ele que estava escondido dentro do número inflado da palavra-alvo: separá-los era obrigatório. Segundo, porque ele é uma medida clínica por si só — num estudo com 439 participantes, o efeito de fechamento apareceu reduzido em pessoas com risco de comprometimento cognitivo leve, sinal de menor alocação à integração semântica.
As três medem a mesma coisa por caminhos diferentes: o quanto a pessoa ainda diferencia. A inclinação diferencia fácil de difícil ao longo de toda a escala. O custo na palavra-alvo diferencia o esperado do absurdo. O fechamento diferencia amarrar o sentido de apenas seguir adiante.
Se a hipótese estiver certa, as três encolhem juntas no comprometimento. E se só uma encolher, isso também informa: diz qual parte do processo cedeu primeiro.
A velocidade diz o quanto a pessoa é lenta. A inclinação diz o quanto o cérebro dela cobra a mais quando a previsão falha — e é isso, e só isso, que a sua tese quer medir.