2024
QGEval: Benchmarking Multi-dimensional Evaluation for Question Generation
EMNLP 2024main
Automatically generated questions often suffer from problems such as unclear expression or factual inaccuracies, requiring a reliable and comprehensive evaluation of their quality. Human evaluation is widely used in the field of question generation (QG) and serves as the gold standard for automatic…