このワークフローは、SAM3 Video Maskingノード(ID: 9cea40bb-b0cf-4b40-a758-8935cfe8d52f)によるテキスト駆動の動画マスキングを実演します。VHS_LoadVideoでクリップを読み込み、「赤い車」「人物」「コーヒーカップ」など自然言語で対象を指定。ノードが全インスタンスを検出し、フレームをまたいでIDを安定して追跡します。出力は3系統:元フレームに色付きマスクを重ねたプレビュー、バイナリ/グレースケールのマスクストリーム、マスク部分だけを切り抜いたストリーム。
技術的には、各フレームでテキスト条件付きの物体検出・セグメンテーションを行い、時系列で検出をリンクしてIDを安定化。VHS_LoadVideoがフレーム列とfpsを供給し、SaveVideoで各出力を保存。素早い反復のため、VHS_LoadVideoのframe_load_capで処理フレーム数を制限可能(0で全フレーム)。MarkdownNoteノードでプロンプト作成やテストのヒントも記載。
API
このワークフローをコードから利用
すべてのComfyワークフローはJSONグラフです。以下のペイロードは、このワークフローそのものであり、ComfyUIが実行する内容と同じです — このURLから取得し、バージョン管理に保存したり、ComfyUIで読み込んでノードごとに実行できます。
Comfy SDKを使ってTypeScriptまたはPythonから実行できます。同じコードでComfy Cloudや自身でホストしたComfyUIのどちらにも対応 — ベースURLだけが異なります。
// Install (beta)
npm i @comfyorg/sdk
// Run this workflow (TypeScript)
import { Comfy } from "@comfyorg/sdk";
const client = new Comfy({ apiKey: "comfyui-..." });
const wf = await client.workflows.fromFile("workflow_api.json");
const job = await client.run(wf);
await job.getOutputs("<output-node-id>")[0].toFile("output.png");SDKはAPI形式のワークフローを受け取ります:このワークフローをComfyUIで開き、「ファイル → ワークフローをエクスポート(API)」を使用してください。
FAQ














