04:00
2026-09-03
arxiv.org
artificial-intelligence
CoViT: Instance-Correspondence Contrastive Learning for Vision Transformer
Researchers propose Contrastive Vision Transformer (CoViT), a self-supervised learning framework that injects instance-awareness into Vision Transformers (ViT) through geometry-guided contrastive learβ¦