model 参数进行选择:
grok-imagine-video:上一代模型,支持可选的图像输入grok-imagine-video-1.5:最新模型,必须提供输入图像,支持 1080p 输出
Grok Imagine Video 1.5 的优势
- 图生视频生成:从单张输入图像生成高质量视频
- 原生音频:音效、环境音和对话在同一生成过程中合成,无需额外的音频管线
- 逼真的运动:运动与已生成的音频保持同步
- 最高 1080p 输出:1.5 模型支持 1080p 分辨率
- 灵活的时长:视频长度从 1 秒到 15 秒
在 ComfyUI 中使用
Grok Imagine Video 1.5 工作流
在本地或 Comfy Cloud 上通过 ComfyUI 运行图生视频工作流