dinov2-small facebook

유형
model
태스크
image-feature-extraction
프레임워크
transformers
다운로드
4,664,473
좋아요
71
접근
public
파일
0

태그

  • 이미지 이해
  • 컴퓨터 비전
  • 비전 트랜스포머
  • 이미지 임베딩
  • 자기지도 학습
  • transformers
  • PyTorch

요약

DINOv2-small은 자기지도 학습 방식으로 대규모 이미지에서 훈련된 Vision Transformer(ViT) 특징 추출 모델로, 파인튜닝 헤드 없이 원시 인코더로 제공됩니다. [CLS] 토큰의 마지막 히든 스테이트를 이미지 전체 표현으로 활용해 분류 등 다양한 다운스트림 작업에 유용합니다. 이미지 특징 추출이 필요한 컴퓨터 비전 파이프라인과 다양한 비전 모델의 백본으로 활용하기 적합합니다.

README

--- license: apache-2.0 tags: - dino - vision --- # Vision Transformer (소형 모델) - DINOv2로 학습됨 DINOv2 방법을 사용하여 학습된 Vision Transformer(ViT) 모델입니다. 이 모델은 Oquab 등의 논문 [DINOv2: Learning Robust Visual Features without Supervision](https://arxiv.org/abs/2304.07193)에서 소개되었으며, [이 저장소](https://github.com/face…

查看完整页面 · 查看原文