vydra/grok-imagineによる画像生成vydra/veo3(テキストから動画)およびvydra/kling(画像から動画)による動画生成- VydraのElevenLabsベースのTTSルートによる音声合成
VYDRA_API_KEYを使用します。
セットアップ
1
対話形式のオンボーディングを実行
2
デフォルト機能を選択
以下の機能(画像、動画、音声)から1つ以上を選び、対応する設定を適用します。
機能
画像生成
画像生成
デフォルトかつ唯一のバンドル済み画像モデル:バンドルされたサポートはテキストから画像への生成のみに対応し、1リクエストにつき最大1枚です。Vydraのホスト型編集ルートではリモート画像URLが必要であり、バンドルされたPluginはVydra固有のアップロードブリッジを追加しません。
vydra/grok-imagine
共通ツールパラメーター、プロバイダーの選択、フェイルオーバー動作については、画像生成を参照してください。
動画生成
動画生成
登録済みの動画モデル:注意事項:
vydra/veo3:テキストから動画(画像参照入力は拒否)vydra/kling:画像から動画(リモート画像URLが1つだけ必要)
vydra/klingはローカルファイルのアップロードを事前に拒否します。使用できるのはリモート画像URL参照のみです。- Vydraの
klingHTTPルートでは、image_urlとvideo_urlのどちらが必要かについて一貫性がありません。バンドルされたプロバイダーは、両方のフィールドに同じリモート画像URLを送信します。 - バンドルされたPluginは保守的な動作を維持し、アスペクト比、解像度、ウォーターマーク、生成音声など、文書化されていないスタイル調整項目を転送しません。
共通ツールパラメーター、プロバイダーの選択、フェイルオーバー動作については、動画生成を参照してください。
動画のライブテスト
動画のライブテスト
プロバイダー固有のライブテスト範囲:バンドルされたVydraのライブテストファイルは、次を対象とします。
vydra/veo3によるテキストから動画への生成- リモート画像URLを使用する
vydra/klingによる画像から動画への生成
音声合成
音声合成
Vydraを音声プロバイダーとして設定します。デフォルト:
- モデル:
elevenlabs/tts - 音声ID:
21m00Tcm4TlvDq8ikWAM(「Rachel」)
関連項目
プロバイダーディレクトリ
利用可能なすべてのプロバイダーを確認します。
画像生成
共通の画像ツールパラメーターとプロバイダーの選択。
動画生成
共通の動画ツールパラメーターとプロバイダーの選択。
設定リファレンス
エージェントのデフォルト値とモデル設定。