fal 提供程序,用于托管图像、视频和音乐
生成。
开始使用
1
设置 API 密钥
--fal-api-key <key> 或导出 FAL_KEY。
在未配置默认图像模型时,初始化还会将 fal/fal-ai/flux/dev 设为默认图像模型。2
设置默认图像模型
图像生成
内置的fal 图像生成提供程序默认使用
fal/fal-ai/flux/dev。
编辑请求(通过共享的
image / images 参数引用参考图像)
会路由到每个模型各自的编辑端点,并遵循各模型的参考图像限制:
Krea 2 模型使用 fal 的原生 Krea 负载架构。OpenClaw 发送
aspect_ratio、creativity 和 image_style_references,而不是 Flux 使用的
通用 image_size/编辑端点负载。模型引用为:
fal/krea/v2/medium/text-to-imagefal/krea/v2/large/text-to-image
fal.creativity: "medium";
支持的值为 raw、low、medium 和 high。
Krea 2 在 fal 的请求架构中暴露的是宽高比,而不是 image_size。优先使用 aspectRatio;
OpenClaw 会将 size 映射为最接近的 Krea 支持的宽高比,并拒绝 Krea 的 resolution
覆盖项,而不是忽略它。
当您希望从暴露 output_format 的 fal 模型获得 PNG 输出时,请使用
outputFormat: "png"。fal 在 OpenClaw 中没有声明明确的透明背景控制,因此
background: "transparent" 会被报告为 fal 模型被忽略的覆盖项。
Krea 2 端点不会通过 fal 暴露 output_format 请求字段,因此
OpenClaw 会拒绝 Krea 请求中的 outputFormat 覆盖项。
要使用 Krea 2 Medium:
视频生成
内置的fal 视频生成提供程序默认使用
fal/fal-ai/minimax/video-01-live。
可用的视频模型
可用的视频模型
MiniMax(默认):
fal/fal-ai/minimax/video-01-live
fal/fal-ai/heygen/v2/video-agent
fal/fal-ai/kling-video/v2.1/master/text-to-videofal/fal-ai/wan/v2.2-a14b/text-to-videofal/fal-ai/wan/v2.2-a14b/image-to-video
fal/bytedance/seedance-2.0/fast/text-to-videofal/bytedance/seedance-2.0/fast/image-to-videofal/bytedance/seedance-2.0/fast/reference-to-videofal/bytedance/seedance-2.0/text-to-videofal/bytedance/seedance-2.0/image-to-videofal/bytedance/seedance-2.0/reference-to-video
aspectRatio、size、resolution、4 到 15 秒的时长,以及
音频开关。Seedance 2.0 配置示例
Seedance 2.0 配置示例
Seedance 2.0 参考生成视频配置示例
Seedance 2.0 参考生成视频配置示例
video_generate images、videos 和 audioRefs
参数接受 9 张图片、3 个视频和 3 个音频参考,
总参考文件数最多为 12 个。音频参考要求
同一请求中至少包含一个图片或视频参考。HeyGen video-agent 配置示例
HeyGen video-agent 配置示例
音乐生成
内置的fal 插件还为共享的 music_generate 工具注册了一个音乐生成提供程序。
将 fal 设为默认音乐提供程序:
fal-ai/minimax-music/v2.6 支持显式歌词和纯音乐模式,
但不能在同一次请求中同时使用。ACE-Step 和 Stable Audio 是
prompt-to-audio 端点;当你需要这些模型系列时,
请使用 model 覆盖来选择它们。ACE-Step 会拒绝显式歌词;Stable Audio 会拒绝
歌词和纯音乐模式。
相关内容
图像生成
共享的图像工具参数和提供程序选择。
视频生成
共享的视频工具参数和提供程序选择。
音乐生成
共享的音乐工具参数和提供程序选择。
配置参考
代理默认设置,包括图像、视频和音乐模型选择。