Skip to main content
OpenClaw 内置了一个 fal 提供商,用于托管式图像、视频和音乐生成。

入门指南

1

设置 API key

非交互式设置可以传入 --fal-api-key <key> 或导出 FAL_KEY。 如果尚未配置默认图像模型,新手引导还会将 fal/fal-ai/flux/dev 设置为默认图像模型。
2

设置默认图像模型

图像生成

内置的 fal 图像生成提供商默认使用 fal/fal-ai/flux/dev 编辑请求(通过共享的 image / images 参数传入参考图像) 会路由到各模型对应的编辑端点,并应用各模型的参考图像数量限制:
Flux 图生图请求支持 aspectRatio 覆盖值。GPT Image 和 Nano Banana 2 编辑请求使用 fal 的 /edit 端点,并接受 宽高比提示。Nano Banana 2 还接受额外的原生横向/纵向比例, 例如 4:11:48:11:8;Krea 2 会验证其自身范围更小的 宽高比子集。Grok Imagine 有自己的比例列表(包括 2:120:919.5:9 及其倒数),并且仅接受 1K/2K 分辨率; 旧版 Nano Banana 和 Nano Banana 2 Lite 拒绝 resolution 覆盖值。
Krea 2 模型使用 fal 的原生 Krea 负载架构。OpenClaw 发送 aspect_ratiocreativityimage_style_references,而不是 Flux 使用的 通用 image_size / 编辑端点负载。模型引用如下:
  • fal/krea/v2/medium/text-to-image
  • fal/krea/v2/large/text-to-image
如需速度更快、表现力更强的插画、动漫、绘画和艺术 风格,请使用 Medium。如需速度较慢的照片级写实、原始纹理、胶片颗粒和精细 效果,请使用 Large。Krea 默认使用 fal.creativity: "medium";支持的值为 rawlowmediumhigh 在 fal 的请求架构中,Krea 2 提供宽高比,而不提供 image_size。优先使用 aspectRatio;OpenClaw 会将 size 映射到最接近的受支持 Krea 宽高比, 并拒绝 Krea 的 resolution,而不是将其丢弃。 当需要从提供 output_format 的 fal 模型获取 PNG 输出时,请使用 outputFormat: "png"。 fal 未在 OpenClaw 中声明明确的透明背景 控制,因此对于 fal 模型,background: "transparent" 会被报告为已忽略的 覆盖值。 Krea 2 端点未通过 fal 公开 output_format 请求字段,因此 OpenClaw 会拒绝 Krea 请求的 outputFormat 覆盖值。 要使用 Krea 2 Medium:

视频生成

内置的 fal 视频生成提供商默认使用 fal/fal-ai/minimax/video-01-live
MiniMax(默认):
  • fal/fal-ai/minimax/video-01-live
HeyGen video-agent:
  • fal/fal-ai/heygen/v2/video-agent
Kling 和 Wan:
  • fal/fal-ai/kling-video/v2.1/master/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/text-to-video
  • fal/fal-ai/wan/v2.2-a14b/image-to-video
Seedance 2.0:
  • fal/bytedance/seedance-2.0/fast/text-to-video
  • fal/bytedance/seedance-2.0/fast/image-to-video
  • fal/bytedance/seedance-2.0/fast/reference-to-video
  • fal/bytedance/seedance-2.0/text-to-video
  • fal/bytedance/seedance-2.0/image-to-video
  • fal/bytedance/seedance-2.0/reference-to-video
MiniMax Live 和 HeyGen 请求仅发送提示词以及可选的 单张参考图像;不会转发其他覆盖值。Seedance 模型 接受 aspectRatiosizeresolution、4-15 秒的时长以及 音频开关。
参考生成视频可通过共享的 video_generate imagesvideosaudioRefs 参数接受最多 9 张图像、3 个视频和 3 个音频参考, 参考文件总数不得超过 12 个。音频参考要求同一请求中 至少包含一个图像或视频参考。

音乐生成

内置的 fal 插件还为共享的 music_generate 工具注册了音乐生成提供商。 将 fal 用作默认音乐提供商:
fal-ai/minimax-music/v2.6 支持显式歌词和纯音乐模式, 但不能在同一请求中同时使用。ACE-Step 和 Stable Audio 是 提示词生成音频端点;当需要使用这些模型系列时,请通过 model 覆盖值选择它们。 ACE-Step 拒绝显式歌词;Stable Audio 同时拒绝歌词和纯音乐模式。
上面的表格和折叠面板涵盖了内置 fal 提供商进行特殊处理的模型系列。仍可选择其他 fal 图像端点 ID 作为 图像模型;它们会按 Flux 方式处理(使用通用 image_size 负载,并通过 /image-to-image 传入一张参考图像)。

相关内容

图像生成

共享的图像工具参数和提供商选择。

视频生成

共享的视频工具参数和提供商选择。

音乐生成

共享的音乐工具参数和提供商选择。

配置参考

Agent 默认配置,包括图像、视频和音乐模型选择。