TMLR 2024
DINOv2: Learning Robust Visual Features without Supervision
Maxime Oquab, Timothée Darcet, +24
How DINOv2 combines DINO self-distillation with iBOT masked prediction at scale on curated data (LVD-142M), producing the strongest open-source frozen visual features across classification, segmentation, depth, and retrieval.
