plugins install n’est nécessaire.
Authentification
DéfinissezELEVENLABS_API_KEY dans l’environnement. XI_API_KEY est également accepté pour
assurer la compatibilité avec les outils ElevenLabs existants.
Synthèse vocale
modelId sur eleven_v3 pour utiliser la synthèse vocale ElevenLabs v3. OpenClaw conserve
eleven_multilingual_v2 comme valeur par défaut pour les installations existantes.
Les salons vocaux Discord utilisent le point de terminaison de synthèse vocale en continu d’ElevenLabs lorsque ce dernier
est le fournisseur voice.tts/messages.tts sélectionné : la lecture commence à partir du
flux audio renvoyé au lieu d’attendre qu’OpenClaw télécharge d’abord l’intégralité du
fichier audio. latencyTier correspond au paramètre de requête optimize_streaming_latency
d’ElevenLabs pour les modèles qui l’acceptent ; OpenClaw omet ce paramètre pour
eleven_v3, qui le refuse.
Transcription vocale
Utilisez Scribe v2 pour les pièces jointes audio entrantes et les courts segments vocaux enregistrés :/v1/speech-to-text d’ElevenLabs avec
model_id: "scribe_v2". Les indications de langue correspondent à language_code lorsqu’elles sont présentes.
Transcription vocale en continu
Le Pluginelevenlabs inclus enregistre Scribe v2 Realtime pour la transcription en continu
de Voice Call et du mode agent de Google Meet.
Voice Call reçoit les médias Twilio au format G.711 u-law à 8 kHz. Le fournisseur temps réel
ElevenLabs utilise
ulaw_8000 par défaut, ce qui permet de transférer les trames téléphoniques sans
transcodage.plugins.entries.google-meet.config.realtime.transcriptionProvider sur
"elevenlabs" et configurez le même bloc de fournisseur sous
plugins.entries.google-meet.config.realtime.providers.elevenlabs.