Aprendizado por Transferência para Correção Automática de Redação

Resumen

A tarefa de Correção Automática de Redação tem despertado crescente interesse na área de processamento de texto em português. Entre os conjuntos de dados disponíveis, destaca-se um corpus de redações narrativas produzidas por alunos do 5º ao 9º ano do ensino fundamental no Brasil. Essas redações são avaliadas segundo quatro competências: registro formal, coerência temática, estrutura retórica narrativa e coesão textual. Este trabalho explora a criação de um sistema baseado em conhecimentos derivados de outro dataset (desenvolvido com base em textos produzidos para o ENEM) e de outras tarefas (cálculo de complexidade textual e análise de legibilidade). O sistema desenvolvido combina modelos neurais, características (features) curadas calculadas por programas de análise textual e seleção de features em um modelo de Aprendizado em Dois Estágios. Com isso, foi possível elevar a performance em relação ao estado-da-arte, nomeadamente, em 9% para a primeira competência, 5,5% para a terceira e 8,9% para a quarta.

Publicado
2026-01-10
Cómo citar
Silveira, I. C., Ribeiro, E., Mamede, N., & Baptista, J. (2026). Aprendizado por Transferência para Correção Automática de Redação. Linguamática, 17(2), preprint. Recuperado a partir de https://www.linguamatica.com/index.php/linguamatica/article/view/493
Sección
Artículos de investigación