dinov2-small facebook
- 種別
- model
- タスク
- image-feature-extraction
- フレームワーク
- transformers
- ダウンロード
- 4,664,473
- いいね
- 71
- アクセス
- public
- ファイル
- 0
タグ
- 特征提取
- 图像分类
- コンピュータビジョン
- 視覚モデル
- 自己教師あり学習
- 表示学习
- 迁移学习
- transformers
概要
Facebookが公開した自己教師あり学習(DINOv2手法)で事前学習されたVision Transformer(ViT-S)モデルです。ラベルなし大規模画像データで学習され、画像の汎用的な特徴表現を獲得しており、[CLS]トークンの隠れ状態を画像全体の表現として画像分類やタスク固有の線形層の学習に利用できます。特徴抽出ベースとして幅広い下流タスクに転用可能で、ヘッドなしの事前学習エンコーダとして提供されます。
README
--- license: apache-2.0 tags: - dino - vision --- # Vision Transformer(小型モデル)をDINOv2で学習 DINOv2メソッドを用いて学習されたVision Transformer(ViT)モデルです。このモデルは、Oquabらによる論文 [DINOv2: Learning Robust Visual Features without Supervision](https://arxiv.org/abs/2304.07193) で紹介され、[このリポジトリ](https://github.com/facebookresea…