Skip to main content
OpenClaw には、ホスト型の画像、動画、音楽生成用の fal プロバイダーがバンドルされています。

はじめに

1

API キーを設定

非対話型セットアップでは、--fal-api-key <key> を渡すか、FAL_KEY をエクスポートできます。 オンボーディングでは、画像モデルが設定されていない場合、 fal/fal-ai/flux/dev もデフォルトの画像モデルとして設定されます。
2

デフォルトの画像モデルを設定

画像生成

バンドルされた fal 画像生成プロバイダーのデフォルトは fal/fal-ai/flux/dev です。 編集リクエスト(共有の image / images パラメーターによる参照画像)は、 モデルごとの参照数制限を持つモデル別の編集エンドポイントにルーティングされます。
Flux の画像間変換リクエストは、aspectRatio の上書きに対応していません。GPT Image と Nano Banana 2 の編集リクエストは fal の /edit エンドポイントを使用し、 アスペクト比のヒントを受け付けます。Nano Banana 2 はさらに、 4:11:48:11:8 など、ネイティブ範囲外の横長・縦長比率も受け付けます。Krea 2 は、 独自のより限定的なアスペクト比のサブセットを検証します。Grok Imagine には独自の比率一覧 (2:120:919.5:9 とその逆比を含む)があり、1K/2K の解像度のみを受け付けます。 レガシー Nano Banana と Nano Banana 2 Lite は、resolution の上書きを拒否します。
Krea 2 モデルは、fal ネイティブの Krea ペイロードスキーマを使用します。OpenClaw は、 Flux で使用される汎用の image_size / 編集エンドポイント用ペイロードの代わりに、 aspect_ratiocreativityimage_style_references を送信します。モデル参照は次のとおりです。
  • fal/krea/v2/medium/text-to-image
  • fal/krea/v2/large/text-to-image
表現力豊かなイラスト、アニメ、絵画、アーティスティックなスタイルを高速に生成するには Medium を使用します。 より低速でも、フォトリアル、自然な質感、フィルムグレイン、細部まで作り込まれた表現を生成するには Large を使用します。 Krea のデフォルトは fal.creativity: "medium" で、対応する値は rawlowmediumhigh です。 fal のリクエストスキーマでは、Krea 2 は image_size ではなくアスペクト比を公開します。 aspectRatio の使用を推奨します。OpenClaw は size を最も近い対応済みの Krea アスペクト比にマッピングし、 破棄するのではなく、Krea に対する resolution を拒否します。 output_format を公開している fal モデルから PNG 出力を得るには、outputFormat: "png" を使用します。 OpenClaw では、fal は透明背景を明示的に制御する機能を宣言していないため、 fal モデルでは background: "transparent" が無視された上書きとして報告されます。 Krea 2 エンドポイントは fal を介して output_format リクエストフィールドを公開しないため、 OpenClaw は Krea リクエストに対する outputFormat の上書きを拒否します。 Krea 2 Medium を使用するには、次のように設定します。

動画生成

バンドルされた fal 動画生成プロバイダーのデフォルトは fal/fal-ai/minimax/video-01-live です。
MiniMax(デフォルト):
  • fal/fal-ai/minimax/video-01-live
HeyGen video-agent:
  • fal/fal-ai/heygen/v2/video-agent
Kling と Wan:
  • fal/fal-ai/kling-video/v2.1/master/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/image-to-video
Seedance 2.0:
  • fal/bytedance/seedance-2.0/fast/text-to-video
  • fal/bytedance/seedance-2.0/fast/image-to-video
  • fal/bytedance/seedance-2.0/fast/reference-to-video
  • fal/bytedance/seedance-2.0/text-to-video
  • fal/bytedance/seedance-2.0/image-to-video
  • fal/bytedance/seedance-2.0/reference-to-video
MiniMax Live と HeyGen のリクエストは、プロンプトと任意の 単一参照画像のみを送信し、その他の上書きは転送されません。Seedance モデルは、 aspectRatiosizeresolution、4~15 秒の長さ、 および音声の切り替えを受け付けます。
参照から動画では、共有の video_generate imagesvideosaudioRefs パラメーターを通じて、最大 9 枚の画像、3 本の動画、3 件の音声参照を受け付けます。 参照ファイルの合計は最大 12 件です。音声参照を使用するには、 同じリクエスト内に少なくとも 1 件の画像または動画参照が必要です。

音楽生成

バンドルされた fal Plugin は、共有の music_generate ツール向けに 音楽生成プロバイダーも登録します。 fal をデフォルトの音楽プロバイダーとして使用します。
fal-ai/minimax-music/v2.6 は明示的な歌詞とインストゥルメンタルモードに対応していますが、 同じリクエストで両方を使用することはできません。ACE-Step と Stable Audio は、 プロンプトから音声を生成するエンドポイントです。これらのモデルファミリーを使用する場合は、 model の上書きで選択します。ACE-Step は明示的な歌詞を拒否し、Stable Audio は 歌詞とインストゥルメンタルモードの両方を拒否します。
上記の表とアコーディオンでは、バンドルされた fal プロバイダーが特別に処理するモデルファミリーを説明しています。 その他の fal 画像エンドポイント ID も画像モデルとして選択できます。それらは Flux と同様に扱われます (汎用の image_size ペイロード、/image-to-image による 1 枚の参照画像)。

関連項目

画像生成

共有画像ツールのパラメーターとプロバイダーの選択。

動画生成

共有動画ツールのパラメーターとプロバイダーの選択。

音楽生成

共有音楽ツールのパラメーターとプロバイダーの選択。

設定リファレンス

画像、動画、音楽モデルの選択を含むエージェントのデフォルト設定。