04:00
2026-09-28
arxiv.org
ai-research
Where Does Retrieval-Based Open-Ended Evaluation Fail? Automatic Taxonomy Induction from Long-Form Medical Answer Factuality Verification
A new arXiv paper (2609.30467v1) introduces two taxonomies for retrieval-based factuality evaluation failures in open-ended medical settings, decomposing errors into retrieval-stage failures across fi…