evaluation-task · Source-linked discovery

WritingBench: A Comprehensive Benchmark for Generative Writing

A comprehensive evaluation benchmark designed to assess large language models' capabilities across diverse writing tasks. The benchmark evaluates models on various writing domains including academic papers, business documents, creative writing, and technical documentation, with multi-dimensional scoring based on domain-specific criteria.

Open interactive record →
OriginYuning Wu, Jiahao Mei, Ming Yan et al.TopicsGeneral capabilityStatusimported

Can support

Not independently assessed by FronteraEval yet.

Cannot support by itself

No inference beyond the upstream source should be made until the protocol is reviewed.

Original sources