Aprimorando o Reconhecimento de Entidades Nomeadas em Textos Literários em Português com Modelos Adaptativos
Resumo
Neste trabalho, investigamos estratégias de pré- treinamento para aprimorar o Reconhecimento de Entidades Nomeadas (REN) em textos literários em português. Introduzimos dois modelos adaptativos ao domínio, LitBERT-CRF e LitBERTimbau, construídos sobre modelos de linguagem de domínio geral. Avaliamos o aprendizado por transferência entre domínios em conjunto com um baseline de domínio geral (BERT-CRF). Nossas análises destacam a eficácia dessas estratégias e suas implicações para tarefas de REN literário. Resultados experimentais revelam que os modelos adaptados e ajustados ao domínio literário superam o baseline, alcançando uma pontuação F1 maior que 75% em um cenário de avaliação estrita e que 80\% em um cenário parcial.
Direitos de Autor (c) 2025 Mariana O. Silva, Mirella Moro

This work is licensed under a Creative Commons Attribution 4.0 International License.
Ao publicar na presente revista, os autores concordam com os seguintes termos:
- os direitos sobre a obra pertencem aos autores, que apenas concedem à Linguamática o direito de primeira publicação sob a licença Creative Commons, que permite que outros possam redistribuir a obra desde que acompanhada de referência ao autor e à Linguamática.
- os autores podem estabelecer outros contratos para a distribuição não exclusiva da obra, desde que mencionem que a sua primeira publicação foi efectuada na Linguamática.
- para aumentar as referências ao seu trabalho, os autores são encorajados a disponibilizar a obra, como "pré-publicação", antes de ou durante o processo de apreciação pela Linguamática, por exemplo em repositórios institucionais ou nas suas páginas pessoais na rede.