Publicação científica
Grading 600+ students: A Case Study on Peer and Self Grading
Classificar turmas grandes tornou-se uma tarefa desafiadora e cara para muitas universidades. A Universidade de Tecnologia de Delft (TU Delft), localizada na Holanda, observou um grande aumento no número de estudantes nos últimos anos. Dado o grande crescimento da população estudantil, avaliar todas as submissões resulta em custos elevados.
Utilizamos autoavaliação e avaliação por pares na edição 2018-2019 de nosso curso de teste de software. Os alunos trabalharam em equipes de dois, e eles mesmos e seus colegas avaliaram três tarefas em nosso curso. Acabamos com 906 envios avaliados por nós mesmos e por pares, que comparamos com 248 envios avaliados por nossos TAs.
Neste artigo, relatamos as diferenças que observamos entre a classificação própria, dos pares e do TA. Nossas descobertas mostram que: (i) as notas próprias tendem a ser 8-10% mais altas do que as notas dos colegas, em média; (ii) as notas dos pares parecem ser um bom aproximador das notas do TA; nos casos em que a classificação própria e a dos pares diferem significativamente, a classificação do TA parece situar-se no meio, e (iii) o género e a nacionalidade do aluno não parecem afectar a classificação própria e dos pares.
Assista a um resumo do artigo em inglês:
BibTeX:
@inproceedings{aniche-self-vs-peer-grading,
author = "Maurício Aniche and Frank Mulder and Felienne Hermans",
title = "Grading 600+ students: A Case Study on Peer and Self Grading",
booktitle = "Proceedings of 43rd International Conference on Software Engineering: Joint Track on Software Engineering Education and Training (ICSE-JSEET)",
year = 2021,
doi = "10.1109/ICSE-SEET52601.2021.00031"
}