Skip to main content
OpenClaw zawiera wbudowanego dostawcę fal do hostowanego generowania obrazów, filmów i muzyki.

Pierwsze kroki

1

Ustaw klucz API

Konfiguracje nieinteraktywne mogą przekazać --fal-api-key <key> lub wyeksportować FAL_KEY. Proces wdrażania ustawia również fal/fal-ai/flux/dev jako domyślny model obrazu, jeśli żaden nie został skonfigurowany.
2

Ustaw domyślny model obrazu

Generowanie obrazów

Wbudowany dostawca generowania obrazów fal domyślnie używa fal/fal-ai/flux/dev. Żądania edycji (obrazy referencyjne przekazywane przez współdzielone parametry image / images) są kierowane do punktu końcowego edycji odpowiedniego modelu, z limitami obrazów referencyjnych zależnymi od modelu:
Żądania przekształcania obrazu w obraz Flux nie obsługują zastępowania aspectRatio. Żądania edycji GPT Image i Nano Banana 2 używają punktu końcowego /edit fal i przyjmują wskazówki dotyczące proporcji obrazu. Nano Banana 2 przyjmuje także dodatkowe natywne, szerokie i wysokie proporcje, takie jak 4:1, 1:4, 8:1 oraz 1:8; Krea 2 weryfikuje własny, mniejszy podzbiór proporcji obrazu. Grok Imagine ma własną listę proporcji (obejmującą 2:1, 20:9, 19.5:9 oraz ich odwrotności) i przyjmuje wyłącznie rozdzielczości 1K/2K; starszy Nano Banana oraz Nano Banana 2 Lite odrzucają zastąpienia resolution.
Modele Krea 2 używają natywnego schematu ładunku Krea w fal. OpenClaw wysyła aspect_ratio, creativity oraz image_style_references zamiast ogólnego ładunku image_size / punktu końcowego edycji używanego przez Flux. Odwołania do modeli to:
  • fal/krea/v2/medium/text-to-image
  • fal/krea/v2/large/text-to-image
Użyj Medium do szybszych, ekspresyjnych ilustracji, anime, malarstwa i stylów artystycznych. Użyj Large do wolniejszych, fotorealistycznych obrazów, surowych tekstur, ziarna filmowego i szczegółowego wyglądu. Domyślną wartością Krea jest fal.creativity: "medium"; obsługiwane wartości to raw, low, medium oraz high. Krea 2 udostępnia proporcje obrazu, a nie image_size, w schemacie żądania fal. Preferuj aspectRatio; OpenClaw mapuje size na najbliższe obsługiwane proporcje obrazu Krea i odrzuca resolution dla Krea zamiast je pomijać. Użyj outputFormat: "png", jeśli chcesz uzyskać dane wyjściowe PNG z modeli fal udostępniających output_format. fal nie deklaruje w OpenClaw jawnej opcji sterowania przezroczystym tłem, dlatego background: "transparent" jest zgłaszane jako zignorowane zastąpienie dla modeli fal. Punkty końcowe Krea 2 nie udostępniają pola żądania output_format przez fal, dlatego OpenClaw odrzuca zastąpienia outputFormat w żądaniach Krea. Aby użyć Krea 2 Medium:

Generowanie wideo

Wbudowany dostawca generowania wideo fal domyślnie używa fal/fal-ai/minimax/video-01-live.
MiniMax (domyślny):
  • fal/fal-ai/minimax/video-01-live
Agent wideo HeyGen:
  • fal/fal-ai/heygen/v2/video-agent
Kling i Wan:
  • fal/fal-ai/kling-video/v2.1/master/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/image-to-video
Seedance 2.0:
  • fal/bytedance/seedance-2.0/fast/text-to-video
  • fal/bytedance/seedance-2.0/fast/image-to-video
  • fal/bytedance/seedance-2.0/fast/reference-to-video
  • fal/bytedance/seedance-2.0/text-to-video
  • fal/bytedance/seedance-2.0/image-to-video
  • fal/bytedance/seedance-2.0/reference-to-video
Żądania MiniMax Live i HeyGen wysyłają wyłącznie prompt oraz opcjonalny pojedynczy obraz referencyjny; inne zastąpienia nie są przekazywane. Modele Seedance przyjmują aspectRatio, size, resolution, czas trwania od 4 do 15 sekund oraz przełącznik dźwięku.
Tryb referencji na wideo przyjmuje do 9 obrazów, 3 filmów i 3 referencji audio przez współdzielone parametry images, videos i audioRefs narzędzia video_generate, przy czym łączna liczba plików referencyjnych nie może przekraczać 12. Referencje audio wymagają co najmniej jednej referencji obrazu lub wideo w tym samym żądaniu.

Generowanie muzyki

Wbudowany plugin fal rejestruje również dostawcę generowania muzyki dla współdzielonego narzędzia music_generate. Użyj fal jako domyślnego dostawcy muzyki:
fal-ai/minimax-music/v2.6 obsługuje jawnie podany tekst utworu oraz tryb instrumentalny, ale nie oba jednocześnie w tym samym żądaniu. ACE-Step i Stable Audio to punkty końcowe przekształcające prompt w dźwięk; wybierz je za pomocą zastąpienia model, gdy chcesz użyć tych rodzin modeli. ACE-Step odrzuca jawnie podany tekst utworu; Stable Audio odrzuca zarówno tekst utworu, jak i tryb instrumentalny.
Powyższe tabele i sekcje rozwijane obejmują rodziny modeli, które wbudowany dostawca fal obsługuje w sposób specjalny. Inne identyfikatory punktów końcowych obrazów fal nadal można wybrać jako model obrazu; są one traktowane jak Flux (ogólny ładunek image_size, jeden obraz referencyjny przez /image-to-image).

Powiązane

Generowanie obrazów

Współdzielone parametry narzędzia obrazów i wybór dostawcy.

Generowanie wideo

Współdzielone parametry narzędzia wideo i wybór dostawcy.

Generowanie muzyki

Współdzielone parametry narzędzia muzyki i wybór dostawcy.

Dokumentacja konfiguracji

Ustawienia domyślne agenta, w tym wybór modeli obrazu, wideo i muzyki.