dinov2-small facebook
- Tipo
- model
- Tarea
- image-feature-extraction
- Framework
- transformers
- Descargas
- 4,664,473
- Me gusta
- 71
- Acceso
- public
- Archivos
- 0
Etiquetas
- modelo visual
- visión por computadora
- preentrenamiento
- aprendizaje autosupervisado
- transformers
- PyTorch
- aprendizaje profundo
Resumen
Modelo Vision Transformer (ViT) pequeño entrenado con el método DINOv2 de Facebook, preentrenado de forma autosupervisada sobre una gran colección de imágenes. Genera representaciones internas robustas de imágenes que se pueden extraer como características para tareas posteriores como clasificación…
README
--- license: apache-2.0 tags: - dino - vision --- # Vision Transformer (modelo de tamaño pequeño) entrenado con DINOv2 Modelo Vision Transformer (ViT) entrenado utilizando el método DINOv2. Fue introducido en el artículo [DINOv2: Learning Robust Visual Features without Supervision](https://arxiv.or…