此 ComfyUI 工作流程利用 Grok 模型生成最長 15 秒的短影片,並自動產生同步音訊。核心為 GrokVideoNode,可接受純文字提示(文字轉影片)或來自 LoadImage 的初始畫格(圖像轉影片)。該節點負責推論,並回傳可直接儲存的影片片段,視覺與模型產生的音訊同步。SaveVideo 節點將結果寫入磁碟,並保留內嵌音訊。
技術上,流程簡潔直接:LoadImage(可選)提供初始畫格給 GrokVideoNode,該節點根據提示與/或參考圖像合成動態與音訊,SaveVideo 將輸出存檔。時長限制 15 秒,確保生成快速且符合模型能力。此流程適合快速概念設計、靜態圖像動畫化,或直接在 ComfyUI 內產製社群短片。
常見問題
常見問題
Showing 30 of 30 templates



















