Image-Text-to-Video
Diffusers
Safetensors
MiniMaxH3ModularPipeline
text-to-video
image-to-video
video-to-video
text-to-audio-video
image-to-audio-video
image-text-to-audio-video
video-to-audio-video
audio-to-audio-video
audio-video-generation
multimodal
synchronized-audio-video
reference-to-audio-video
Instructions to use MiniMaxAI/MiniMax-H3 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- Diffusers
How to use MiniMaxAI/MiniMax-H3 with Diffusers:
pip install -U diffusers transformers accelerate
import torch from diffusers import DiffusionPipeline # switch to "mps" for apple devices pipe = DiffusionPipeline.from_pretrained("MiniMaxAI/MiniMax-H3", dtype=torch.bfloat16, device_map="cuda") prompt = "Astronaut in a jungle, cold color palette, muted colors, detailed, 8k" image = pipe(prompt).images[0] - Notebooks
- Google Colab
- Kaggle
非常棒的多模态能力。是否可以基于这个扩展生图能力?
#37
by wdtd - opened
感谢开放这么强大的模型。我也注意到这个模型具有强大的语意理解能力。我想知道这个是否能理解白模和人偶?是否能使用其强大的理解和生成能力来生图和编辑图片?这我认为比较重要。可以用来生成故事板,分镜。
后续会有同系列的图像生成和编辑模型,可以期待一下
wan2.2生图挺不错,不知道这个H3生图如何?有试过的吗?