clip-vit-base-patch32 openai

Typ
model
Aufgabe
zero-shot-image-classification
Framework
transformers
Downloads
21,108,465
Likes
1,000
Zugriff
public
Dateien
0

Tags

  • Zero-Shot-Klassifikation
  • 图像分类
  • 多模态
  • 视觉模型
  • 计算机视觉
  • 图像嵌入
  • transformers

Zusammenfassung

CLIP ist ein multimodales Modell von OpenAI, das Bild- und Textdarstellungen über einen kontrastiven Verlust in einen gemeinsamen Embedding-Raum bringt. Es ermöglicht Zero-Shot-Bildklassifikation ohne zusätzliches Training, indem Bild-Text-Ähnlichkeiten berechnet werden. Das Modell eignet sich für …

README

--- tags: - vision widget: - src: https://huggingface.co/datasets/mishig/sample_images/resolve/main/cat-dog-music.png candidate_labels: playing music, playing sports example_title: Cat & Dog --- # Modellkarte: CLIP Hinweis: Die Modellkarte wurde aus dem offiziellen CLIP-Repository übernommen und mo…

查看完整页面 · 查看原文