Teoria da carga cognitiva e exemplos resolvidos em matemática
Resumo executivo
- A Teoria da Carga Cognitiva (CLT, John Sweller, UNSW) assume memória de trabalho muito limitada e memória de longo prazo (esquemas) quase ilimitada; a instrução deve minimizar a carga “extrínseca” (má concepção) e proteger a carga “relevante” (germane, construção de esquemas) [1][13].
- Efeito do exemplo resolvido: para iniciantes, estudar um exemplo resolvido ensina mais, em menos tempo e com menos erros, do que resolver o mesmo problema do zero (Sweller e Cooper, 1985) [1][2].
- Reversão da perícia (Kalyuga): ao ganhar competência, esse mesmo andamiaje torna-se redundante e prejudica a aprendizagem [3][4].
- A solução prática é o desvanecimento (fading, Renkl): passar gradualmente de exemplo completo → um passo em branco → problema completo [5][6].
- Os prompts de autoexplicação (Chi) potencializam o efeito; combinados com o desvanecimento produzem ganhos médios-grandes em transferência próxima e distante sem tempo extra de estudo (Atkinson, Renkl e Merrill, 2003) [6][14].
- Atenção dividida e redundância são erros de design: separar diagrama e texto, ou repetir a mesma informação em dois canais, desperdiça memória de trabalho [7].
- Efeito livre de meta: pedir “encontre todos os valores que puder” em vez de “encontre X” reduz a carga da busca meios-fins [8].
- A CLT tem problemas sérios de base: não existe uma medida confiável de carga cognitiva (usa-se majoritariamente uma escala de um único item) e a teoria atravessou várias crises de replicação [9].
- A pressão de tempo não é neutra: para ~1/3 dos alunos (Ashcraft) a prova cronometrada origina a ansiedade matemática, e essa ansiedade ocupa memória de trabalho como uma tarefa secundária [11][12].
- Implicação central: pontuar por velocidade não é gratuito — ao aprender algo novo, a velocidade mede sobretudo a automatização prévia, não a compreensão.
- Recomendação: mostrar exemplo resolvido a quem não conhece o padrão, desvanecer passos ao acertar, e não cronometrar até que o padrão esteja consolidado.
Este documento foi traduzido do original em inglês por Claude (Anthropic) e verificado automaticamente contra a fonte: cada número, URL, marcador de citação e marca [unverified] corresponde ao original. A prosa em si ainda não foi revisada por um editor humano nativo.
Estado de verificação
Este documento não traz nenhuma marca [unverified]. Cada afirmação está ligada a uma fonte numerada abaixo.
[unverified] significa que a afirmação está na pesquisa mas não foi confirmada contra uma fonte primária na sessão que a produziu. É publicada em vez de removida, porque um corpus que esconde suas lacunas não é verificável.
Como esta pesquisa foi produzida
Os 47 documentos foram produzidos em 2026-07-31 por agentes independentes, cada um com instrução de não inventar citações e de marcar como [unverified] o que não pudesse confirmar contra uma fonte primária. A cota de busca na web da sessão se esgotou no meio do caminho e os agentes seguintes trabalharam por download direto de fontes primárias. Vários sites (ftc.gov, ico.org.uk) bloqueiam download automatizado, e por isso certas afirmações jurídicas estão marcadas de propósito.
Isto é pesquisa, não aconselhamento jurídico, médico ou financeiro. Nada aqui reivindica um resultado de aprendizagem do Math Challenge; esse estudo ainda não existe.
Resultados
1. Núcleo teórico: memória de trabalho, esquemas e três cargas
A CLT modela a cognição humana segundo a divisão de Geary entre conhecimento biologicamente primário (preparado evolutivamente, por exemplo, linguagem falada) e conhecimento biologicamente secundário (culturalmente importante, mas não preparado, por exemplo, aritmética escrita e álgebra) [13]. Como a matemática é biologicamente secundária, ela deve ser ensinada explicitamente, e é limitada pela memória de trabalho, que retém apenas alguns elementos novos de cada vez e os perde em segundos, a menos que sejam organizados em um esquema de memória de longo prazo [1][13]. A CLT divide a carga em intrínseca (complexidade inevitável, impulsionada pela interatividade dos elementos — quantas peças interativas precisam ser mantidas na mente simultaneamente), extrínseca (adicionada por design pobre, sem valor de aprendizagem) e relevante (germane — processamento esforçado que constrói o esquema). O design deve minimizar a carga extrínseca para que a capacidade sobrante sirva ao processamento relevante [1][7][13].
2. O efeito do exemplo resolvido
Sweller e Cooper (1985) ensinaram álgebra em cinco experimentos e descobriram que, mantendo o tempo de estudo constante, estudantes que usaram exemplos resolvidos resolveram os problemas do pós-teste aproximadamente duas vezes mais rápido e com cerca de um quinto dos erros dos estudantes que resolveram sem ajuda desde o início [1][2]. A resolução de problemas sem apoio força um processo de busca que compete com a construção de esquemas; ler um exemplo, por sua vez, direciona toda a capacidade ao reconhecimento da estrutura da solução. Sweller o chama de “o efeito de carga cognitiva mais conhecido e mais amplamente estudado” [1]. Trabalhos posteriores (Van Gog, Kester & Paas, 2011) mostram que pares apenas de exemplo ou alternando exemplo-problema superam a resolução pura de problemas em outros domínios procedimentais (por exemplo, análise de circuitos), de modo que o efeito se generaliza além da álgebra [1].
3. Reversão da expertise e redundância
O benefício não é permanente. Kalyuga demonstrou, em engenharia, circuitos de relé e treinamento de PLC, que a vantagem dos exemplos resolvidos sobre a resolução de problemas diminui e se inverte à medida que os aprendizes ganham experiência [3][4]. Mecanismo: já existe um esquema eficiente, de modo que reapresentar cada passo força o processamento de informação desnecessária, desperdiçando capacidade que poderia ser usada em prática de recuperação — e nega a própria prática [3][4]. Isso levou Sweller a revisar sua afirmação de 1988 de que a resolução de problemas deveria ser geralmente minimizada: a quantidade correta de resolução sem apoio é uma função da expertise atual, não da fase curricular [4].
4. Desvanecimento, problemas de conclusão e autoexplicação
O desvanecimento de Renkl: começar totalmente resolvido, depois omitir um passo (um problema de conclusão), depois mais, até que o aprendiz resolva sem ajuda. O desvanecimento pode ser progressivo ou regressivo; o regressivo (omitir o último passo primeiro) é geralmente recomendado, pois o passo final costuma ancorar a conexão com o objetivo [5]. Exemplos desvanecidos em geometria produziram compreensão conceitual mais profunda que blocos de exemplos não desvanecidos [5]. O desvanecimento sozinho ajuda de forma confiável na transferência próxima, mas não na distante. Atkinson, Renkl e Merrill (2003, J. Educational Psychology, 95(4), 774–783) combinaram desvanecimento com sugestões de autoexplicação — breves perguntas que pedem aos aprendizes que declarem o princípio por trás de cada passo, baseando-se na descoberta de Chi de que aprendizes fortes se autoexplicam espontaneamente e aprendizes fracos não o fazem [6][14]. Em dois experimentos essa combinação produziu ganhos de médio a grande porte tanto na transferência próxima quanto na distante, sem tempo de estudo adicional — “altamente recomendável” segundo os autores [6]. Uma meta-análise mais ampla de autoexplicação relata um tamanho de efeito médio em torno de g = 0,66 em 69 comparações [14].
5. Atenção dividida e redundância no design
Dois efeitos de falha de design. Atenção dividida: a compreensão requer integrar mentalmente fontes fisicamente ou temporalmente separadas (diagrama separado da legenda, ou um passo mostrado antes da explicação); materiais integrados e bem-desenhados superam os divididos [7]. Redundância: apresentar a mesma informação duas vezes em canais diferentes (por exemplo, narrar o texto na tela palavra por palavra) adiciona custo de reconciliação sem benefício [7]. Para interfaces de matemática: um passo da solução e o raciocínio por trás dele devem ocupar a mesma região visual ao mesmo tempo; escolha um canal por unidade de informação.
6. O efeito livre de objetivo
Um problema de objetivo específico (“resolver para x”) desencadeia análise meios-fins: manter simultaneamente o estado objetivo, o estado atual, sua diferença e os operadores candidatos — alta carga, útil para encontrar a resposta, mas pobre para aprender o método, pois a atenção persegue o objetivo em vez da estrutura [8]. Uma versão livre de objetivo (“encontre quantos valores puder”) remove o alvo, de modo que os aprendizes avançam de forma oportunista a partir do que sabem, reduzindo a carga e direcionando a atenção para a estrutura, melhorando a aprendizagem mesmo que não pareça “resolver o problema” [8].
7. Críticas, problemas de mensuração e debate de replicação
O principal defensor da CLT reconhece uma história de “crises de replicação e incorporação de outras teorias”, revisada mais de uma vez após falhas de replicação — mais visivelmente a postura de 1988 de minimizar a resolução de problemas, revertida pela reversão da expertise [3][4][9]. A crítica não resolvida mais profunda é a mensuração: não existe um instrumento validado e confiável para a própria carga cognitiva; a prática dominante é um único item de autorrelato de esforço, que não pode ser verificado quanto à confiabilidade e confunde esforço sentido com o que a manipulação realmente fez à memória de trabalho [9]. Muitos efeitos clássicos são inferidos a partir de resultados comportamentais (erros, transferência, tempo) com a carga tratada como não medida — razoável em agregados, mas difícil de diagnosticar caso a caso. Críticos também observam que “carga cognitiva” às vezes funciona como rótulo pós-hoc para qualquer resultado consistente com a teoria, em vez de um constructo medido independentemente — uma crítica compartilhada com a literatura mais ampla de crise de replicação na psicologia, não exclusiva da CLT [9].
8. Prática cronometrada, pontuação por velocidade e ansiedade matemática
Mais relevante para um design de pontos-por-velocidade. O programa de Ashcraft mostra que a ansiedade matemática funciona como uma tarefa secundária concorrente, ocupando a memória de trabalho (o componente executivo) que de outra forma serviria à aritmética — produzindo erros e lentidão que parecem um déficit de competência, mas são um déficit de recursos induzido pela ansiedade, não pela matemática [11]. Testes cronometrados revelam de forma confiável lacunas ligadas à ansiedade em aritmética que não aparecem em testes sem tempo do mesmo conteúdo — o relógio, não a matemática, é o que está sendo medido sob pressão para aprendizes ansiosos [11][12]. Boaler: o início de testes cronometrados é, para uma parcela significativa de estudantes, o ponto de origem da própria ansiedade matemática, e, uma vez ansiosos, a memória de trabalho é parcialmente consumida por essa ansiedade, bloqueando o acesso a fatos que eles normalmente conhecem — um ciclo de autorreforço [12]. A evidência não é unilateral: alguns estudos encontram que condições com tempo equivalente podem aumentar a acurácia, e um estudo não encontrou interação significativa de três vias entre memória, ansiedade e cronometragem [11] — real, mas moderado pelo nível de ansiedade e por se “cronometrado” significa um relógio rígido ou disponibilidade ritmada.
Síntese: a velocidade é um marcador legítimo de automaticidade quando um esquema está consolidado — recuperação rápida e sem esforço é exatamente o que a carga relevante (germane) “pagou” [1][13]. Mas a velocidade medida antes da consolidação não mede compreensão; mede o processo esforçado que o aprendiz está substituindo, e um relógio sobreposto a isso adiciona exatamente a carga extrínseca que a CLT recomenda evitar, no momento em que a memória de trabalho deve ser protegida, não sobrecarregada [1][7][8][11].
Implicações de design para o Math Challenge
- Apresente um exemplo completo resolvido antes da primeira tentativa da criança em um novo padrão (nunca resolvido, ou as últimas N tentativas nessa habilidade falharam) em vez de “lutar primeiro” — corresponde ao efeito de exemplo resolvido para iniciantes [1][2].
- Nunca emparelhe “novo padrão” com um cronômetro regressivo. Pontuação de velocidade com peso zero nas primeiras exposições; introduza o tempo somente depois que o padrão for resolvido corretamente sem um exemplo resolvido presente [11][12].
- Desvaneça automaticamente a partir de um sinal de domínio, não de uma contagem fixa de itens: acurácia recente, uso de dicas, contagem de passos não auxiliados selecionam o próximo degrau (exemplo completo → um vazio → dois vazios → problema completo), conforme a sequência de problemas de conclusão de Renkl [5][6].
- Desvanecimento tendencioso para trás (omitir o último passo primeiro), já que isso ancora a conexão objetivo e deve ser praticado cedo [5].
- Emparelhe cada passo desvanecido com um prompt de autoexplicação de um toque (escolha múltipla para idades mais jovens, texto livre/voz para mais velhos) — a única intervenção que mostrou adicionar transferência distante sem custo de tempo [6][14].
- Projete contra atenção dividida e redundância na UI: mantenha um passo e sua explicação na mesma região visual simultaneamente; nunca narre e exiba texto idêntico ao mesmo tempo [7].
- Use enquadramentos sem objetivo para itens de posicionamento/diagnóstico (“encontre quantos valores puder”) para revelar conhecimento prévio com carga menor, mudando para pontuação específica de objetivo quando a avaliação de domínio começar [8].
- Trate a reversão de expertise como parada rígida ao apoio: acima de um limiar de domínio, retenha exemplos resolvidos/dicas por padrão (disponíveis apenas sob demanda), pois apoio redundante prejudica mensuravelmente aprendizes avançados [3][4].
- Desacople pontos de correção dos pontos de velocidade como canais separadamente ajustáveis; peso de velocidade padrão próximo de zero até que a escada de desvanecimento alcance “problema completo, sem dicas”. Informe pais/professores explicitamente que aumentar o peso de velocidade eleva a variância ligada à ansiedade para aprendizes abaixo do domínio [11][12].
- Não deixe que um temporizador global de sessão/sequência substitua a barreira de domínio por habilidade — um relógio de nível meta pode reintroduzir o mesmo efeito de ansiedade mesmo com problemas sem tempo; torne os temporizadores de sequência opcionais e nunca bloqueie o acesso a exemplos resolvidos.
- Registre qual degrau de desvanecimento a criança precisou como sinal de domínio para professores/pais, não apenas a correção — a forma de retirada de apoio é, por si, diagnóstica da força do esquema [5][6].
- Não instrumente excessivamente “carga cognitiva” diretamente (por exemplo, apenas a variância do tempo de resposta); use proxies validados comportamentalmente — trajetória de acurácia ao longo da escada de desvanecimento, qualidade da autoexplicação — já que mesmo a própria literatura da TCC não possui medida direta de carga validada para se basear [9].
Perguntas abertas para o dono do projeto
- Os pontos baseados em velocidade devem estar ativados por padrão para qualquer faixa etária, dado o evidência de ansiedade, ou ser opt-in por conta de pai/professor?
- Qual limiar de domínio (por exemplo, N respostas corretas consecutivas no degrau “problema completo”) deve controlar a transição de sem tempo para com tempo por habilidade?
- Os prompts de autoexplicação devem ser obrigatórios ou opcionais, considerando que crianças de ~4-6 anos podem não ter linguagem metacognitiva suficiente?
- “Encontre quantos valores puder” (enquadramento sem objetivo) traduz-se de forma limpa entre EN/ES/FR/PT/DE sem perder sua abertura?
- A escada de desvanecimento deve ser visível para a criança, ou invisível/apenas no backend?
Fontes
- [Worked-example effect — Wikipedia](
- [Sweller, J., & Cooper, G. A. (1985). The Use of Worked Examples as a Substitute for Problem Solving in Learning Algebra. Cognition and Instruction, 2(1), 59–89 — citation record](
- [Expertise reversal effect — Wikipedia](
- [The "Expertise Reversal Effect" — Cognitive Load Theory (blog, summarizing Kalyuga et al. 2001, 2003, 2007)](
- [Exploring the Use of Faded Worked Examples — ERIC](
- [Atkinson, R. K., Renkl, A., & Merrill, M. M. (2003). Transitioning From Studying Examples to Solving Problems: Effects of Self-Explanation Prompts and Fading Worked-Out Steps. Journal of Educational Psychology, 95(4), 774–783 — ERIC record](
- [Split attention effect — Wikipedia](
- [The Goal-Free Effect (Sweller & Ayres) — Semantic Scholar](
- [The Development of Cognitive Load Theory: Replication Crises and Incorporation of Other Theories Can Lead to Theory Expansion — Educational Psychology Review (2023)](
- [Cognitive load theory: Research that teachers really need to understand — NSW Department of Education (CESE, 2017)](
- [Ashcraft, M., & Krause, J. (2007). Working Memory, Math Performance, and Math Anxiety. Psychonomic Bulletin & Review, 14, 243–248](
- [Boaler, J. Speed and Time Pressure Blocks Working Memory (Stanford / youcubed, reprint)](
- [Sweller, J. (2019 et al.). Cognitive Architecture and Instructional Design: 20 Years Later. Educational Psychology Review](
- [Chi, M. T. H., & Leeuw, N. Eliciting Self-Explanations Improves Understanding — Semantic Scholar](
- [Does working memory moderate the effect of fading on math performance? Miller-Cotto et al. British Journal of Educational Psychology (2026)](
- [Sweller, J. (1988). Cognitive Load During Problem Solving: Effects on Learning. Cognitive Science, 12(2), 257–285 — Wiley Online Library](
Perguntas que este documento deixa em aberto
Ficam sem resposta de propósito. São listadas, não resolvidas — transformá-las em FAQ exigiria inventar respostas que o documento não tem.
- Should speed-based points be on by default for any age band given the anxiety evidence, or opt-in per parent/teacher account?
- What mastery threshold (e.g., N consecutive correct at "full problem" rung) should gate untimed-to-timed transition per skill?
- Should self-explanation prompts be mandatory or skippable, given ages ~4-6 may lack the metacognitive language for them?
- Does "find as many values as you can" (goal-free framing) translate cleanly across EN/ES/FR/PT/DE without losing its open-endedness?
- Should the fading ladder be visible to the child, or invisible/backend-only?
Um de 51 documentos de pesquisa, 168.346 palavras no total, contadas na compilação a partir dos próprios arquivos. Ler este documento no repositório