stable-diffusion-xl-base-1.0 stabilityai

種別
model
タスク
text-to-image
フレームワーク
diffusers
ダウンロード
1,531,109
いいね
8,044
アクセス
public
ファイル
0

タグ

  • テキストから画像生成
  • 拡散モデル
  • 画像生成
  • diffusers
  • コンピュータビジョン
  • 生成AI
  • 視覚モデル

概要

Stability AIが開発したSDXL 1.0のベースモデルで、テキストプロンプトから高解像度かつ高品質な画像を生成する潜在拡散モデルです。2つの事前学習済みテキストエンコーダ(OpenCLIP-ViT/GとCLIP-ViT/L)を用い、リファイナーモデルと組み合わせることでさらに精細な出力が得られます。diffusersやONNX/OpenVINOを通じて手軽に推論でき、アート制作やデザイン、生成モデルの研究などに活用できます。

README

--- license: openrail++ tags: - text-to-image - stable-diffusion --- # SD-XL 1.0-base モデルカード ![row01](01.png) ## モデル ![pipeline](pipeline.png) [SDXL](https://arxiv.org/abs/2307.01952) は、潜在拡散のための [専門家のアンサンブル](https://arxiv.org/abs/2211.01324) パイプラインで構成されています。 最初のステップでは、ベースモデルを使用して(ノイズを含む)潜在変数を生成し、 次…

查看完整页面 · 查看原文