dinov2-small facebook

Tipo
model
Tarea
image-feature-extraction
Framework
transformers
Descargas
4,664,473
Me gusta
71
Acceso
public
Archivos
0

Etiquetas

  • modelo visual
  • visión por computadora
  • preentrenamiento
  • aprendizaje autosupervisado
  • transformers
  • PyTorch
  • aprendizaje profundo

Resumen

Modelo Vision Transformer (ViT) pequeño entrenado con el método DINOv2 de Facebook, preentrenado de forma autosupervisada sobre una gran colección de imágenes. Genera representaciones internas robustas de imágenes que se pueden extraer como características para tareas posteriores como clasificación…

README

--- license: apache-2.0 tags: - dino - vision --- # Vision Transformer (modelo de tamaño pequeño) entrenado con DINOv2 Modelo Vision Transformer (ViT) entrenado utilizando el método DINOv2. Fue introducido en el artículo [DINOv2: Learning Robust Visual Features without Supervision](https://arxiv.or…

查看完整页面 · 查看原文