Tudo que o araneuron cita, com o que cada trabalho prova em três ou quatro linhas. Organizado por função, não por ordem alfabética — para achar rápido o que sustenta cada argumento.
conferido Todas as 27 entradas desta página (28 trabalhos — a de Sereno reúne dois) foram verificadas em base indexada — as cinco clínicas em 23/08/2026 as oito de base teórica em 24/08/2026 e as seis clínicas em 25/08/2026 e as cinco de método em 28/08/2026. Volume, número, páginas e identificador conferem. Podem ir direto para texto formal.
Cada entrada traz DOI ou PMID ao final: é o que permite colar a referência num gerenciador (Zotero, Mendeley) sem reprocurar, e o link do trabalho. Em verde com ↓ está o que dá para ler de graça; em azul com ↗, o que exige assinatura.
Por que a dificuldade de uma palavra se mede em bits, e por que uma reta a resume.
Hale, J. (2001). A probabilistic Earley parser as a psycholinguistic model. Proceedings of the 2nd Meeting of the North American Chapter of the ACL (NAACL), 1–8. ACL Anthology N01-1021
Introduziu o surprisal como medida de custo de processamento: o esforço de ler uma palavra é proporcional a −log P(palavra|contexto). É a origem teórica de medir dificuldade em bits em vez de em frequência ou tamanho. Prova conceitual, não empírica — é o modelo, não o experimento.
Usada em a inclinaçãoLevy, R. (2008). Expectation-based syntactic comprehension. Cognition, 106(3), 1126–1177. PMID 17662975
↓ PDF livre (página do autor) ↗ PubMed
Desenvolveu a teoria: a compreensão é guiada por expectativa, e o custo de processar surge quando a expectativa precisa ser realocada. Formalizou por que o custo é o logaritmo da probabilidade e não a probabilidade — o que dá à medida a unidade bit.
Usada em a inclinaçãoSmith, N. J., & Levy, R. (2013). The effect of word predictability on reading time is logarithmic. Cognition, 128(3), 302–319. doi 10.1016/j.cognition.2013.02.013
↓ PDF livre (página do autor) ↗ ScienceDirect
A referência que licencia a inclinação. Em corpora grandes de leitura (rastreamento ocular e leitura autocadenciada), o tempo cresce como função linear do surprisal, e continua linear por cerca de seis ordens de grandeza de probabilidade. Se a relação fosse curva, uma pessoa não caberia num número só — é a linearidade que permite resumir alguém por um ângulo.
Usada em a inclinaçãoBrothers, T., & Kuperberg, G. R. (2021). Word predictability effects are linear, not logarithmic: implications for probabilistic models of sentence comprehension. Journal of Memory and Language, 116, 104174. doi 10.1016/j.jml.2020.104174
↓ PDF livre (página do laboratório) ↗ ScienceDirect
A objeção mais séria que este projeto vai receber, e ela é publicada. Em dois experimentos e uma meta-análise, a relação entre previsibilidade e tempo foi linear na probabilidade cloze, e não logarítmica — o que contradiz a teoria do surprisal e, com ela, a unidade ms por bit. Os autores propõem pré-ativação proporcional no lugar.
Usada em a inclinaçãoShain, C., Meister, C., Pimentel, T., Cotterell, R., & Levy, R. (2024). Large-scale evidence for logarithmic effects of word predictability on reading time. PNAS, 121(10), e2307876121. doi 10.1073/pnas.2307876121
↓ TEXTO COMPLETO livre (PMC) ↗ PNAS
A resposta à objeção acima, e o que mantém a inclinação de pé. Em corpora grandes de leitura, o efeito da previsibilidade sobre o tempo é logarítmico — equivalente a dizer que é linear no surprisal, que é a premissa deste instrumento. A questão não está encerrada: há trabalho publicado dos dois lados, e o honesto é dizer isso em vez de citar só o lado que convém.
Usada em a inclinaçãoJust, M. A., Carpenter, P. A., & Woolley, J. D. (1982). Paradigms and processes in reading comprehension. Journal of Experimental Psychology: General, 111(2), 228–238. PMID 6213736 (réplica associada)
O paradigma que este instrumento usa, descrito na origem. É o trabalho que estabelece a janela móvel autocadenciada: a pessoa aperta para ver cada palavra, e a anterior desaparece. Os autores comparam com rastreamento ocular e encontram os mesmos efeitos por palavra — e registram que o leitor pausa mais no fim da frase, que é o efeito que o araneuron desconta.
Usada em as contasWarren, T., White, S. J., & Reichle, E. D. (2009). Investigating the causes of wrap-up effects: evidence from eye movements and E–Z Reader. Cognition, 111(1), 132–137. PMID 19215911
A referência que faltava para a correção de posição. O wrap-up — o tempo extra na palavra que fecha a frase — está descrito desde Just & Carpenter (1980) e é atribuído à integração do sentido do período. Importa aqui porque não tem nada a ver com surpresa: sem descontá-lo, ele entra na conta disfarçado de custo de previsibilidade e infla a inclinação.
Usada em as contas e a inclinaçãoSchuckart, M. M., Martin, S., Tune, S., Schmitt, L.-M., Hartwigsen, G., & Obleser, J. (2026). Executive resources shape the impact of language predictability across the adult lifespan. eLife, 14, RP108176. doi 10.7554/eLife.108176.3
↓ TEXTO COMPLETO livre ↗ PubMed
Duas coisas, e as duas importam. Com 175 participantes de 18 a 85 anos, mais replicação em 96, lendo palavra a palavra com surpresa calculada por modelo de linguagem: o efeito de previsibilidade é maior no idoso que no jovem — ou seja, envelhecer sozinho não achata a reta, o que reforça a hipótese do projeto. E a ressalva: carga cognitiva reduz o efeito. Um participante cansado, distraído ou sob pressão produz reta achatada por motivo banal — que é exatamente o que as perguntas de verificação existem para barrar.
Usada em a inclinaçãoA prova biológica de que o cérebro reage à surpresa de significado.
Kutas, M., & Hillyard, S. A. (1980). Reading senseless sentences: brain potentials reflect semantic incongruity. Science, 207(4427), 203–205. doi 10.1126/science.7350657
Descobriu o N400: uma onda negativa por volta de 400 ms depois da palavra, maior quando a palavra não encaixa no sentido da frase. É o achado fundador de toda a área — a demonstração de que o cérebro sinaliza a surpresa semântica, e não apenas a processa em silêncio.
Usada em surpresa em bitsKutas, M., & Hillyard, S. A. (1984). Brain potentials during reading reflect word expectancy and semantic association. Nature, 307, 161–163. PMID 6690995
Mostrou que a amplitude do N400 varia com a previsibilidade da palavra — quanto menos esperada, maior a onda. A conferência trouxe a formulação exata do artigo: a amplitude é função inversa da probabilidade cloze da palavra final. Não é liga-desliga: é contínua. É o análogo eletrofisiológico exato da inclinação que este instrumento mede em milissegundos.
Usada em a inclinaçãoAs duas referências que sustentam a premissa inteira do projeto.
Olichney, J. M., Taylor, J. R., Gatherwright, J., Salmon, D. P., Bressler, A. J., Kutas, M., & Iragui-Madoz, V. J. (2008). Patients with MCI and N400 or P600 abnormalities are at very high risk for conversion to dementia. Neurology, 70(19 Pt 2), 1763–1770. PMID 18077800
↓ TEXTO COMPLETO livre (PMC) ↗ PubMed
O número mais forte da bibliografia. Pessoas com comprometimento cognitivo leve e efeito de repetição N400/P600 reduzido tiveram 87–88% de chance de converter para demência em 3 anos. Quem tinha o efeito preservado: 11–27%. Prova que a falha do sistema preditivo antecede a demência e prevê quem vai converter — e é o que justifica medir isso como rastreio.
Usada em a inclinação e no roteiro de reuniãoFernández, G., Schumacher, M., Castro, L., Orozco, D., & Agamennoni, O. (2014). Lack of contextual-word predictability during reading in patients with mild Alzheimer disease. Neuropsychologia, 62, 143–151. doi 10.1016/j.neuropsychologia.2014.07.023
↗ ScienceDirect ↓ cópia no Academia.edu
A âncora — e o trabalho que este projeto não pode deixar de citar. 20 pacientes com Alzheimer leve e 40 controles pareados por idade, em espanhol, com rastreador ocular. A previsibilidade da palavra encurtou o olhar nos controles e não teve efeito nos pacientes. É exatamente a reta achatada. O mecanismo do araneuron, portanto, não é hipótese: é premissa publicada. O que resta ao projeto é fazer isso sem laboratório, em CCL, em português.
Usada em duas leituras, as contas, a economia, a inclinação, o roteiro e na conversa com o orientadorO que Fernández NÃO resolve. Ele mostra que o ângulo achata. A altura de cada reta — e portanto a distância exata entre elas em cada palavra — continua aberta: o próprio trabalho relata pacientes mais lentos em geral, o que sobe a reta inteira. São dois efeitos somados. Não apresente número de distância como se fosse achado publicado.
A concorrência direta, e por que ela não ocupa o mesmo lugar.
Validation of reading as a predictor of mild cognitive impairment. Scientific Reports (2025). Estudo esloveno, rastreador ocular Tobii 4C a 90 Hz.
Rastreio de CCL por leitura, com 115 e depois 94 participantes. Acurácia de ~73% (AUC 79,7%) na amostra inicial e ~67% (AUC 75%) na validação. Ponto crítico: não usa previsibilidade nenhuma — só mecânica do olho (sacadas, duração e regularidade de fixações). Ou seja, chega perto do mesmo objetivo por um caminho diferente, e deixa a previsibilidade em CCL em aberto.
De onde saem os marcos em milissegundos usados nas explicações.
Sereno, S. C., Rayner, K., & Posner, M. I. (1998). Establishing a time-line of word recognition: evidence from eye movements and event-related potentials. NeuroReport, 9(10), 2195–2200. · Sereno, S. C., & Rayner, K. (2003). Measuring word recognition in reading: eye movements and event-related potentials. Trends in Cognitive Sciences, 7(11), 489–493. PMID 14585445 · o de 1998, PMID 9694199
↗ TiCS 2003 ↗ NeuroReport 1998
Combinaram movimento ocular e potenciais evocados para datar cada etapa do reconhecimento de uma palavra. É a fonte dos marcos que aparecem nas explicações — e o que esclarece que o N400 não é um atraso, é um momento: acontece em toda palavra, em todo mundo. O que muda entre pessoas é o tamanho da onda, não a existência dela.
Usada em as contasDehaene, S., & Cohen, L. (2011). The unique role of the visual word form area in reading. Trends in Cognitive Sciences, 15(6), 254–262. PII S1364-6613(11)00073-8
↓ PDF livre (UniCog) ↗ Cell Press
De onde vem a “caixa de letras do cérebro”. Descreve a área da forma visual da palavra, no sulco occipitotemporal esquerdo, onde por volta de 150 ms um amontoado de traços passa a ser uma palavra. Antes disso o sinal é processado como forma qualquer, no occipital, por volta de 115 ms. Importa aqui porque delimita onde começa o que este teste mede: tudo o que interessa acontece depois desse ponto. A região não nasce pronta — especializa-se com a alfabetização.
Usada em as contasA régua que mostra que este teste não mede leitura natural — e por que tudo bem.
Carver, R. P. (1992). Reading rate: theory, research, and practical implications. Journal of Reading, 36(2), 84–95. (teoria do rauding) ERIC EJ451276
Descreve cinco marchas de leitura, de memorizar (≈138 ppm) a varrer (≈600 ppm), cada uma com sua velocidade típica. Serve como régua externa: as listas do araneuron rodam abaixo da marcha mais lenta de Carver, o que não é defeito de quem lê — é o paradigma. Tocar a tela a cada palavra insere uma decisão motora que a leitura natural não tem.
Usada em as contasBrysbaert, M. (2019). How many words do we read per minute? A review and meta-analysis of reading rate. Journal of Memory and Language, 109, 104047. doi 10.1016/j.jml.2019.104047
↓ PDF livre ↗ ScienceDirect
A régua moderna da velocidade de leitura, e a que substitui as estimativas antigas: 190 estudos, cerca de 18 mil participantes, de 1901 a 2019. Leitura silenciosa de adultos: 238 palavras por minuto em texto expositivo — por volta de 250 ms por palavra. Serve aqui como ponto de comparação externo: os ~600 ms por palavra deste teste são mais que o dobro, e a diferença é o preço do paradigma — a decisão de avançar e o movimento do dedo, que a leitura natural não tem.
E um número que fecha outra discussão: leitura em voz alta sai a 183 ppm contra 238 da silenciosa. Ler falando é cerca de 30% mais lento — mais um motivo para não exigir leitura em voz alta como prova de que a pessoa leu. O trabalho também registra que a taxa cai em idosos, o que reforça parear os grupos por idade.
Usada em as contasO método clássico, e o problema de trocá-lo por um modelo de linguagem.
Taylor, W. L. (1953). “Cloze procedure”: a new tool for measuring readability. Journalism Quarterly, 30(4), 415–433. doi 10.1177/107769905303000401
Criou o cloze: apagar a palavra e pedir que pessoas a completem. A proporção que acerta vira a previsibilidade. É o padrão-ouro há setenta anos e é o que Fernández usou. Caro: exige dezenas de respondentes por frase. É por isso que o araneuron tenta substituí-lo por modelo de linguagem — e é por isso que a norma humana em complete a frase ainda precisa ser coletada, para validar a troca.
Oh, B.-D., & Schuler, W. (2023). Why does surprisal from larger transformer-based language models provide a poorer fit to human reading times? Transactions of the ACL, 11, 336–350. doi 10.1162/tacl_a_00548
A ressalva metodológica mais importante do projeto. Modelos de linguagem maiores preveem pior o tempo de leitura humano do que modelos menores — escala invertida. Consequência prática: não adianta trocar o modelo por um maior esperando melhora, e o número em bits é do modelo, não da humanidade. É o argumento que obriga a validar contra norma humana.
Por que rastreio barato importa aqui mais do que em qualquer lugar.
Miguel, A. C. C., et al. (2025). Undetected dementia in Brazil. Alzheimer's & Dementia.
80,2% das pessoas com demência acima de 60 anos no Brasil nunca receberam o diagnóstico. Por região: Norte 95,6%, Nordeste 90,0%, Centro-Oeste 88,6%, Sul 74,8%, Sudeste 72,9%. Maior em homens (82,2% contra 78,1%) e nas faixas mais jovens (90,7% entre 60 e 64 anos). É o número que define o problema: o gargalo não é diagnosticar, é chegar até quem precisa ser avaliado.
Usada no roteiro de reuniãoMiguel, A. C. C., et al. Bridging the gap: estimates of undetected dementia in Brazil. Age and Ageing, 55(6), afag163.
Estimativa mais recente e mais alta: 84,3% (intervalo 81,5–86,4) para 2024, usando prescrição de anticolinesterásicos no SUS como proxy de caso reconhecido. Confirma e agrava o número acima. Vale citar junto — mostra que o problema não está diminuindo.
Os números que aparecem no roteiro de reunião — remédios, rastreios existentes e prevenção. Conferidos em 25/08/2026.
Departamento Científico de Neurologia Cognitiva e do Envelhecimento, Academia Brasileira de Neurologia (2024). Uso de terapias antiamiloide para a doença de Alzheimer no Brasil: um posicionamento. Dementia & Neuropsychologia. PMC11556288
↓ texto completo livre (PMC) ↓ PDF em Dement. Neuropsychol.
O documento brasileiro sobre os remédios novos. Define critérios de seleção de paciente, exige patologia amiloide comprovada e faz a conta que interessa a este projeto: US$ 25 mil por ano o lecanemabe e US$ 32 mil o donanemabe — inviável para o SUS sem estudo de custo-efetividade. Ou seja, a janela terapêutica existe mas não é acessível em escala, o que reforça o valor de rastrear barato e de agir sobre fator de risco.
Usada em roteiro de reuniãovan Dyck, C. H., et al. (2023). Lecanemab in early Alzheimer’s disease (ensaio CLARITY AD). New England Journal of Medicine, 388(1), 9–21. doi 10.1056/NEJMoa2212948
De onde vem o “27%”. Em 18 meses, a piora na CDR-SB foi de 1,21 ponto no grupo tratado contra 1,66 no placebo — diferença de 0,45, ou 27% menos declínio. Os dois grupos pioraram. É o número que impede a conversa de virar promessa de cura.
Usada em roteiro de reuniãoSims, J. R., et al. (2023). Donanemab in early symptomatic Alzheimer disease (ensaio TRAILBLAZER-ALZ 2). JAMA, 330(6), 512–527. doi 10.1001/jama.2023.13239
Em 76 semanas: 35% de desaceleração no desfecho primário (iADRS), 36% na CDR-SB e 39% menos risco de progredir para o estágio seguinte. Cite a escala junto com o número — dizer só “36%” é o tipo de imprecisão que um neurologista corrige na hora.
Usada em roteiro de reuniãoLivingston, G., et al. (2024). Dementia prevention, intervention, and care: 2024 report of the Lancet standing Commission. The Lancet, 404(10452), 572–628. publicado em 31/07/2024
↗ The Lancet ↓ resumo livre (Alzheimer Europe)
Até 45% dos casos de demência seriam evitáveis agindo sobre 14 fatores de risco ao longo da vida. Os dois novos, em relação ao relatório de 2020, são colesterol LDL alto na meia-idade e perda visual não tratada. É o argumento mais forte a favor de achar cedo: prevenção não depende de remédio caro.
Usada em roteiro de reuniãoNakamura, A. E., Opaleye, D., Tani, G., & Ferri, C. P. (2015). Dementia underdiagnosis in Brazil. The Lancet, 385(9805), 418–419. PMID 25706975 · 31/01/2015
O número antigo de subdiagnóstico no Brasil. Saiu do Departamento de Psicobiologia da própria UNIFESP — vale mencionar se o interlocutor for de lá. Hoje está superado pelos dados de Miguel (80,2%) e do Age and Ageing (84,3%), mas serve para mostrar que o problema é antigo e piorou, não melhorou.
Usada em roteiro de reuniãoNasreddine, Z. S., et al. (2020). MoCA test mandatory training and certification: what is the purpose? Journal of the American Geriatrics Society. Mudança de política anunciada pelo MoCA Cognition. doi 10.1111/jgs.16267
↓ mudança oficial ↗ artigo na JAGS
A certificação para aplicar o MoCA tornou-se obrigatória em 2019 e, desde dezembro de 2025, voltou a ser opcional para quem usa o teste apenas para rastreio, triagem ou encaminhamento pelo escore total. Importa porque a barreira de aplicação do concorrente mais próximo acabou de cair — não use “precisa de certificação” como argumento sem essa ressalva.
Usada em roteiro de reuniãoSe alguém perguntar “qual a base disso?”, os itens 1, 2 e 3 respondem. Se perguntar “o que é seu, então?”, o item 3 (Fernández) e o item 4 delimitam exatamente o que sobra.
Uma única correção saiu da conferência. A referência de Hale (2001) estava sem as páginas — é NAACL, 1–8. As outras oito estavam exatas como escritas. Nada mais precisou mudar.