このComfyUIワークフローは、Grokモデルを使って最大15秒の短い動画を自動生成し、音声も自動で同期されます。GrokVideoNodeが中心となり、テキストプロンプト(テキストから動画)またはLoadImageからの初期フレーム(画像から動画)を受け付けます。このノードが推論を行い、映像とモデル生成の音声を組み合わせた動画クリップを出力します。SaveVideoで結果を標準動画ファイルとして保存し、音声も埋め込まれます。
技術的には、LoadImage(任意)で初期フレームをGrokVideoNodeに渡し、プロンプトや画像をもとに動きとサウンドトラックを合成、SaveVideoでファイルに保存するというシンプルな構成です。15秒以内に制限することで応答性とモデルの性能を両立。アイデア出し、静止画のアニメーション化、SNS用ショートクリップ作成など、ComfyUI内で完結する実用的なパイプラインです。
FAQ
よくある質問
Showing 30 of 30 templates



















