此 ComfyUI 工作流程利用 Grok 模型生成最長 15 秒的短影片,並自動產生同步音訊。核心為 GrokVideoNode,可接受純文字提示(文字轉影片)或來自 LoadImage 的初始畫格(圖像轉影片)。該節點負責推論,並回傳可直接儲存的影片片段,視覺與模型產生的音訊同步。SaveVideo 節點將結果寫入磁碟,並保留內嵌音訊。

技術上,流程簡潔直接:LoadImage(可選)提供初始畫格給 GrokVideoNode,該節點根據提示與/或參考圖像合成動態與音訊,SaveVideo 將輸出存檔。時長限制 15 秒,確保生成快速且符合模型能力。此流程適合快速概念設計、靜態圖像動畫化,或直接在 ComfyUI 內產製社群短片。

常見問題

常見問題

查看所有工作流
Character
Cinematic
Image to Video
Lip Sync
Multiple Angles
Portrait
Style Reference
Style Transfer
Text to Video
Video Generation
Video
Showing 30 of 30 templates