04:00
2026-09-22
arxiv.org
large-language-models
Beyond Accuracy and Surface Fluency: Risk-Sensitive Evaluation of LLMs for Legal Clause Generation
A new arXiv paper proposes a risk-sensitive evaluation framework for large language models that draft legal contract clauses, arguing that conventional accuracy and preference-based benchmarks miss leβ¦