Skip to main content
OpenClaw поставляется со встроенным провайдером fal для размещённой генерации изображений, видео и музыки.

Начало работы

1

Задайте ключ API

При неинтерактивной настройке можно передать --fal-api-key <key> или экспортировать FAL_KEY. Процесс первоначальной настройки также задаёт fal/fal-ai/flux/dev как модель изображений по умолчанию, если модель не настроена.
2

Задайте модель изображений по умолчанию

Генерация изображений

Встроенный провайдер генерации изображений fal по умолчанию использует fal/fal-ai/flux/dev. Запросы на редактирование (эталонные изображения передаются через общие параметры image / images) направляются в отдельную конечную точку редактирования для каждой модели с соответствующими ограничениями на число эталонных изображений:
Запросы Flux на преобразование изображения в изображение не поддерживают переопределения aspectRatio. Запросы GPT Image и Nano Banana 2 на редактирование используют конечную точку fal /edit и принимают указания соотношения сторон. Nano Banana 2 также поддерживает дополнительные нестандартные широкие и высокие соотношения, такие как 4:1, 1:4, 8:1 и 1:8; Krea 2 проверяет собственное, более узкое подмножество соотношений сторон. У Grok Imagine есть собственный список соотношений (включая 2:1, 20:9, 19.5:9 и обратные им), и он принимает только разрешения 1K/2K; устаревшая версия Nano Banana и Nano Banana 2 Lite отклоняют переопределения resolution.
Модели Krea 2 используют собственную схему полезной нагрузки Krea в fal. OpenClaw отправляет aspect_ratio, creativity и image_style_references вместо универсальной полезной нагрузки image_size / конечной точки редактирования, используемой Flux. Ссылки на модели:
  • fal/krea/v2/medium/text-to-image
  • fal/krea/v2/large/text-to-image
Используйте Medium для более быстрой генерации выразительных иллюстраций, аниме, живописи и художественных стилей. Используйте Large для более медленной генерации фотореалистичных изображений, естественных текстур, плёночной зернистости и детализированного внешнего вида. По умолчанию Krea использует fal.creativity: "medium"; поддерживаемые значения: raw, low, medium и high. В схеме запроса fal Krea 2 предоставляет соотношение сторон, а не image_size. Предпочтительно использовать aspectRatio; OpenClaw сопоставляет size с ближайшим поддерживаемым соотношением сторон Krea и отклоняет resolution для Krea, а не игнорирует его. Используйте outputFormat: "png", если нужен вывод PNG из моделей fal, предоставляющих output_format. fal не объявляет в OpenClaw явный параметр управления прозрачным фоном, поэтому background: "transparent" указывается как проигнорированное переопределение для моделей fal. Конечные точки Krea 2 не предоставляют поле запроса output_format через fal, поэтому OpenClaw отклоняет переопределения outputFormat для запросов Krea. Чтобы использовать Krea 2 Medium:

Генерация видео

Встроенный провайдер генерации видео fal по умолчанию использует fal/fal-ai/minimax/video-01-live.
MiniMax (по умолчанию):
  • fal/fal-ai/minimax/video-01-live
Видеoагент HeyGen:
  • fal/fal-ai/heygen/v2/video-agent
Kling и Wan:
  • fal/fal-ai/kling-video/v2.1/master/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/image-to-video
Seedance 2.0:
  • fal/bytedance/seedance-2.0/fast/text-to-video
  • fal/bytedance/seedance-2.0/fast/image-to-video
  • fal/bytedance/seedance-2.0/fast/reference-to-video
  • fal/bytedance/seedance-2.0/text-to-video
  • fal/bytedance/seedance-2.0/image-to-video
  • fal/bytedance/seedance-2.0/reference-to-video
Запросы MiniMax Live и HeyGen отправляют только подсказку и необязательное единственное эталонное изображение; другие переопределения не передаются. Модели Seedance принимают aspectRatio, size, resolution, длительность от 4 до 15 секунд и переключатель звука.
Преобразование эталонов в видео принимает до 9 изображений, 3 видео и 3 звуковых эталонов через общие параметры video_generate images, videos и audioRefs, при этом общее число эталонных файлов не должно превышать 12. Для звуковых эталонов в том же запросе требуется как минимум один эталон изображения или видео.

Генерация музыки

Встроенный плагин fal также регистрирует провайдер генерации музыки для общего инструмента music_generate. Чтобы использовать fal как провайдер музыки по умолчанию:
fal-ai/minimax-music/v2.6 поддерживает явное указание текста песни и инструментальный режим, но не одновременно в одном запросе. ACE-Step и Stable Audio — это конечные точки преобразования подсказки в аудио; выберите их с помощью переопределения model, если нужны эти семейства моделей. ACE-Step отклоняет явно указанный текст песни; Stable Audio отклоняет и текст песни, и инструментальный режим.
Таблицы и раскрывающиеся разделы выше охватывают семейства моделей, которые встроенный провайдер fal обрабатывает особым образом. Другие идентификаторы конечных точек изображений fal также можно выбирать в качестве модели изображений; они обрабатываются как Flux (универсальная полезная нагрузка image_size, одно эталонное изображение через /image-to-image).

Связанные материалы

Генерация изображений

Общие параметры инструмента изображений и выбор провайдера.

Генерация видео

Общие параметры инструмента видео и выбор провайдера.

Генерация музыки

Общие параметры инструмента музыки и выбор провайдера.

Справочник по конфигурации

Значения агентов по умолчанию, включая выбор моделей изображений, видео и музыки.