- 通过
vydra/grok-imagine生成图像 - 通过
vydra/veo3(文本生成视频)和vydra/kling(图像生成视频)生成视频 - 通过 Vydra 基于 ElevenLabs 的 TTS 路由合成语音
VYDRA_API_KEY。
设置
1
运行交互式新手引导
2
选择默认能力
从以下能力(图像、视频或语音)中选择一种或多种,并应用对应的配置。
能力
图像生成
图像生成
默认且唯一的内置图像模型:内置支持仅限文本生成图像,每个请求最多生成一张图像。Vydra 托管的编辑路由要求使用远程图像 URL,而内置插件未添加 Vydra 专用的上传桥接。
vydra/grok-imagine
有关共享工具参数、提供商选择和故障转移行为,请参阅图像生成。
视频生成
视频生成
已注册的视频模型:注意:
vydra/veo3用于文本生成视频(拒绝图像引用输入)vydra/kling用于图像生成视频(要求恰好提供一个远程图像 URL)
vydra/kling会预先拒绝本地文件上传;仅支持远程图像 URL 引用。- Vydra 的
klingHTTP 路由对于究竟要求image_url还是video_url一直表现不一致;内置提供商会在两个字段中发送同一个远程图像 URL。 - 内置插件采取保守策略,不会转发未记录的样式选项,例如宽高比、分辨率、水印或生成的音频。
有关共享工具参数、提供商选择和故障转移行为,请参阅视频生成。
视频实时测试
视频实时测试
提供商专用的实时测试覆盖:内置的 Vydra 实时测试文件涵盖:
vydra/veo3文本生成视频vydra/kling使用远程图像 URL 生成图像转视频
语音合成
语音合成
将 Vydra 设置为语音提供商:默认值:
- 模型:
elevenlabs/tts - 语音 ID:
21m00Tcm4TlvDq8ikWAM(“Rachel”)
相关内容
提供商目录
浏览所有可用的提供商。
图像生成
共享图像工具参数和提供商选择。
视频生成
共享视频工具参数和提供商选择。
配置参考
Agent 默认值和模型配置。