16:46
2026-08-22
runtimewire.com
machine-learning
FINAL-Bench finds a 0.21 AUROC gap between time and random splits
VIDRAFT's FINAL-Bench leaderboard reveals a 0.21 AUROC gap between time-based and random data splits, with a baseline LightGBM model scoring 0.606 AUROC on chronological splits versus 0.818 on random โฆ