MiniMax-H3 MiniMaxAI
- 種別
- model
- ライセンス
- other
- タスク
- image-text-to-video
- フレームワーク
- minimax-h3
- ダウンロード
- 2,212,155
- いいね
- 3,978
- パラメータ
- 33,122,992,896
- アクセス
- public
- ファイル
- 280
タグ
- 文生视频
- 多模态
- 音声動画生成
- 動画生成
- 生成AI
- diffusers
概要
MiniMax-H3は、テキスト・画像・動画・音声を横断的に理解し、ネイティブなステレオ音声付きの動画を最大2K解像度・15秒間で生成できる汎用全モーダル生成システムです。テキストから動画、画像とテキストから動画、参照画像・動画・音声からの動画生成など多様な入力モードに対応し、複雑なマルチモーダル指示の追従性能に優れています。API・Webアプリ・オープンソース版として提供され、映画制作やクリエイティブコンテンツ生成などの用途に適しています。
README
--- pipeline_tag: image-text-to-video license: other license_name: minimax-h3-community-license-agreement license_link: LICENSE library_name: minimax-h3 tags: - text-to-video - image-to-video - image-text-to-video - video-to-video - text-to-audio-video - image-to-audio-video - image-text-to-audio-v…