DeFAb: A Verifiable Benchmark for Defeasible Abduction in Foundation Models
Researchers introduced DeFAb, a benchmark for defeasible abduction in foundation models, converting knowledge bases into 372,648+ logically verifiable instances. Frontier language models achieved at m…