plugins install не потрібен.
Автентифікація
УстановітьELEVENLABS_API_KEY у середовищі. XI_API_KEY також підтримується для
сумісності з наявними інструментами ElevenLabs.
Синтез мовлення з тексту
modelId значення eleven_v3, щоб використовувати синтез мовлення ElevenLabs v3. OpenClaw зберігає
eleven_multilingual_v2 як значення за замовчуванням для наявних інсталяцій.
Голосові канали Discord використовують потокову кінцеву точку синтезу мовлення ElevenLabs, коли ElevenLabs
вибрано як постачальника voice.tts/messages.tts: відтворення починається з
отриманого аудіопотоку, не очікуючи, поки OpenClaw спочатку завантажить увесь
аудіофайл. latencyTier зіставляється з параметром запиту ElevenLabs optimize_streaming_latency
для моделей, які його підтримують; OpenClaw не передає цей параметр для
eleven_v3, оскільки ця модель його відхиляє.
Розпізнавання мовлення
Використовуйте Scribe v2 для вхідних аудіовкладень і коротких записаних голосових фрагментів:/v1/speech-to-text із
model_id: "scribe_v2". Підказки щодо мови, якщо вони наявні, зіставляються з language_code.
Потокове розпізнавання мовлення
Вбудований Pluginelevenlabs реєструє Scribe v2 Realtime для потокового розпізнавання мовлення
у Voice Call і режимі агента Google Meet.
Voice Call отримує медіадані Twilio у форматі 8 кГц G.711 u-law. Постачальник ElevenLabs для обробки в реальному часі
за замовчуванням використовує
ulaw_8000, тому кадри телефонного аудіо можна передавати без
транскодування.plugins.entries.google-meet.config.realtime.transcriptionProvider у значення
"elevenlabs" і налаштуйте такий самий блок постачальника в
plugins.entries.google-meet.config.realtime.providers.elevenlabs.