07:56
2026-09-17
snipvote.com
computer-vision
CaptionQA outperforms VideoQA on 10 of 12 models for long egocentric videos
CaptionQA, a caption-based memory approach that segments egocentric video into 30-to-60-second windows, outperformed direct VideoQA on 10 of 12 models for videos longer than 20 minutes, according to a…