- 使用
vydra/grok-imagine进行图像生成 - 使用
vydra/veo3(文生视频)和vydra/kling(图生视频)进行视频生成 - 使用基于 ElevenLabs 的 Vydra TTS 路由进行语音合成
VYDRA_API_KEY。
设置
1
安装插件
2
运行交互式引导
3
选择默认能力
从下面的能力中选择一个或多个(图像、视频或语音),并应用相应的配置。
功能
图像生成
图像生成
默认且唯一的 Vydra 图像模型:Vydra 仅支持文生图,每次请求最多生成一张图像。Vydra 托管的编辑路由要求使用远程图像 URL,该插件不会添加 Vydra 专用的上传桥接。
vydra/grok-imagine
有关共享工具参数、提供方选择和故障转移行为,请参见图像生成。
视频生成
视频生成
已注册的视频模型:注:
vydra/veo3用于文生视频(拒绝图像引用输入)vydra/kling用于图生视频(要求恰好一个远程图像 URL)
vydra/kling会预先拒绝本地文件上传;只有远程图像 URL 引用可用。- Vydra 的
klingHTTP 路由对于要求使用image_url还是video_url一直不一致;该插件会在两个字段中发送相同的远程图像 URL。 - 该插件采取保守策略,不会转发宽高比、分辨率、水印或生成音频等未记录的样式参数。
有关共享工具参数、提供方选择和故障转移行为,请参见视频生成。
视频实时测试
视频实时测试
提供方特定的实时覆盖:Vydra 实时测试文件涵盖:
vydra/veo3文本生成视频- 使用远程图像 URL 的
vydra/kling图像生成视频
语音合成
语音合成
将 Vydra 设置为语音提供方:默认值:
- 模型:
elevenlabs/tts - 声音 id:
21m00Tcm4TlvDq8ikWAM(“Rachel”)
相关内容
提供方目录
浏览所有可用的提供方。
图像生成
共享的图像工具参数和提供方选择。
视频生成
共享的视频工具参数和提供方选择。
配置参考
智能体默认值和模型配置。