stable-diffusion-v1-4 CompVis
- 类型
- model
- 任务
- text-to-image
- 框架
- diffusers
- 下载量
- 440,022
- 点赞
- 7,053
- 访问
- public
- 文件
- 0
标签
- 文生图
- 图像生成
- 扩散模型
- 生成式AI
- 视觉模型
- diffusers
- 计算机视觉
- PyTorch
摘要
Stable Diffusion v1-4 是 CompVis 发布的潜空间文本到图像扩散模型,使用预训练 CLIP 文本编码器,可根据任意文本提示生成照片级写实图像,并支持对图像进行修改。该模型在 512x512 分辨率下于 laion-aesthetics v2 5+ 数据集微调,支持 classifier-free guidance 采样,专为 Diffusers 库设计使用。适用于文本生成图像、创意艺术生成等场景,但需遵守 CreativeML OpenRAIL-M 许可使用限制。
README
--- license: creativeml-openrail-m tags: - stable-diffusion - stable-diffusion-diffusers - text-to-image widget: - text: "A high tech solarpunk utopia in the Amazon rainforest" example_title: Amazon rainforest - text: "A pikachu fine dining with a view to the Eiffel Tower" example_title: Pikachu in…