stable-diffusion-v-1-4-original CompVis
- 유형
- model
- 태스크
- text-to-image
- 프레임워크
- stable-diffusion
- 다운로드
- 3
- 좋아요
- 2,881
- 접근
- public
- 파일
- 0
태그
- 텍스트-투-이미지
- 확산 모델
- 이미지 생성
- 생성형AI
- 멀티모달
- diffusers
- 딥러닝
요약
Stable Diffusion v1.4는 잠재 공간에서 작동하는 확산 모델로, CLIP ViT-L/14 텍스트 인코더를 사용해 텍스트 프롬프트만으로 사실적인 이미지를 생성한다. LAION-2B(en) 데이터셋으로 사전학습 후 512x512 해상도에서 미세조정되어 연구, 예술 창작, 디자인 등에 널리 활용된다. 다만 영어 캡션에 최적화되어 있어 비영어 프롬프트 성능이 낮고 텍스트 렌더링 및 복잡한 구성에는 한계가 있다.
README
--- license: creativeml-openrail-m tags: - stable-diffusion - text-to-image library_name: "stable-diffusion" inference: false extra_gated_prompt: |- 이 모델을 받기 전에 한 단계가 더 있습니다. 이 모델은 누구나 접근할 수 있으며, CreativeML OpenRAIL-M 라이선스가 권리와 사용에 대해 자세히 규정합니다. CreativeML OpenRAIL 라이선스는 다음을 명시합니다: 1. 이 모델을 사용하여 불법…