dinov2-small facebook

Typ
model
Aufgabe
image-feature-extraction
Framework
transformers
Downloads
4,664,473
Likes
71
Zugriff
public
Dateien
0

Tags

  • 图像嵌入
  • 视觉模型
  • 计算机视觉
  • 无监督学习
  • transformers
  • 图像分类

Zusammenfassung

Dieses Modell ist ein kleiner Vision Transformer (ViT), der mit der DINOv2-Methode in selbstüberwachter Weise auf großen Bildsammlungen vortrainiert wurde. Es dient zur Extraktion robuster visueller Merkmale, die für nachgelagerte Aufgaben wie Bildklassifikation oder Bildverständnis genutzt werden …

README

--- license: apache-2.0 tags: - dino - vision --- # Vision Transformer (kleines Modell), trainiert mit DINOv2 Vision Transformer (ViT)-Modell, trainiert mit der DINOv2-Methode. Es wurde in dem Paper [DINOv2: Learning Robust Visual Features without Supervision](https://arxiv.org/abs/2304.07193) von …

查看完整页面 · 查看原文