MiniMax-H3 MiniMaxAI

種別
model
ライセンス
other
タスク
image-text-to-video
フレームワーク
minimax-h3
ダウンロード
2,212,155
いいね
3,978
パラメータ
33,122,992,896
アクセス
public
ファイル
280

タグ

  • 文生视频
  • 多模态
  • 音声動画生成
  • 動画生成
  • 生成AI
  • diffusers

概要

MiniMax-H3は、テキスト・画像・動画・音声を横断的に理解し、ネイティブなステレオ音声付きの動画を最大2K解像度・15秒間で生成できる汎用全モーダル生成システムです。テキストから動画、画像とテキストから動画、参照画像・動画・音声からの動画生成など多様な入力モードに対応し、複雑なマルチモーダル指示の追従性能に優れています。API・Webアプリ・オープンソース版として提供され、映画制作やクリエイティブコンテンツ生成などの用途に適しています。

README

--- pipeline_tag: image-text-to-video license: other license_name: minimax-h3-community-license-agreement license_link: LICENSE library_name: minimax-h3 tags: - text-to-video - image-to-video - image-text-to-video - video-to-video - text-to-audio-video - image-to-audio-video - image-text-to-audio-v…

查看完整页面 · 查看原文