clip-vit-base-patch32 openai
- Typ
- model
- Aufgabe
- zero-shot-image-classification
- Framework
- transformers
- Downloads
- 21,108,465
- Likes
- 1,000
- Zugriff
- public
- Dateien
- 0
Tags
- Zero-Shot-Klassifikation
- 图像分类
- 多模态
- 视觉模型
- 计算机视觉
- 图像嵌入
- transformers
Zusammenfassung
CLIP ist ein multimodales Modell von OpenAI, das Bild- und Textdarstellungen über einen kontrastiven Verlust in einen gemeinsamen Embedding-Raum bringt. Es ermöglicht Zero-Shot-Bildklassifikation ohne zusätzliches Training, indem Bild-Text-Ähnlichkeiten berechnet werden. Das Modell eignet sich für …
README
--- tags: - vision widget: - src: https://huggingface.co/datasets/mishig/sample_images/resolve/main/cat-dog-music.png candidate_labels: playing music, playing sports example_title: Cat & Dog --- # Modellkarte: CLIP Hinweis: Die Modellkarte wurde aus dem offiziellen CLIP-Repository übernommen und mo…