Avaliação comparativa de Modelos de Linguagem para a transcrição automática de sentenças judiciais orais portuguesas

Este estudo avalia 9 modelos de linguagem de grande dimensão (LLM) na tarefa de
correcção de erros de transcrição automática de sentenças judiciais portuguesas, com o
objectivo de identificar o modelo que maximiza a preservação da extensão textual num
cenário de execução em infraestrutura interna. Um corpus de 17 sentenças penais de
primeira instância, transcritas pelo Whisper large-v3-turbo, constitui a base da avaliação usada.