dinov2-small facebook
- Typ
- model
- Aufgabe
- image-feature-extraction
- Framework
- transformers
- Downloads
- 4,664,473
- Likes
- 71
- Zugriff
- public
- Dateien
- 0
Tags
- 图像嵌入
- 视觉模型
- 计算机视觉
- 无监督学习
- transformers
- 图像分类
Zusammenfassung
Dieses Modell ist ein kleiner Vision Transformer (ViT), der mit der DINOv2-Methode in selbstüberwachter Weise auf großen Bildsammlungen vortrainiert wurde. Es dient zur Extraktion robuster visueller Merkmale, die für nachgelagerte Aufgaben wie Bildklassifikation oder Bildverständnis genutzt werden …
README
--- license: apache-2.0 tags: - dino - vision --- # Vision Transformer (kleines Modell), trainiert mit DINOv2 Vision Transformer (ViT)-Modell, trainiert mit der DINOv2-Methode. Es wurde in dem Paper [DINOv2: Learning Robust Visual Features without Supervision](https://arxiv.org/abs/2304.07193) von …