2025
WritingBench: A Comprehensive Benchmark for Generative Writing
NeurIPS 2025poster
Recent advancements in large language models (LLMs) have significantly enhanced text generation capabilities, yet evaluating their performance in generative writing remains a challenge. Existing benchmarks primarily focus on generic text generation or limited in writing tasks, failing to capture the…