plugins install nie jest potrzebny.
Uwierzytelnianie
UstawELEVENLABS_API_KEY w środowisku. Ze względu na zgodność z istniejącymi
narzędziami ElevenLabs akceptowany jest również XI_API_KEY.
Synteza mowy z tekstu
modelId na eleven_v3, aby używać syntezy mowy ElevenLabs v3. W istniejących
instalacjach OpenClaw zachowuje eleven_multilingual_v2 jako wartość domyślną.
Gdy ElevenLabs jest wybranym dostawcą voice.tts/messages.tts, kanały głosowe Discord
korzystają z jego strumieniowego punktu końcowego syntezy mowy: odtwarzanie rozpoczyna się
zwracanym strumieniem audio, zamiast czekać, aż OpenClaw najpierw pobierze cały
plik audio. latencyTier jest odwzorowywany na parametr zapytania
optimize_streaming_latency usługi ElevenLabs w przypadku modeli, które go obsługują;
OpenClaw pomija ten parametr dla eleven_v3, który go odrzuca.
Rozpoznawanie mowy
Użyj Scribe v2 do przychodzących załączników audio i krótkich nagranych fragmentów głosowych:/v1/speech-to-text
z wartością model_id: "scribe_v2". Jeśli podano wskazówki dotyczące języka, są one
odwzorowywane na language_code.
Strumieniowe rozpoznawanie mowy
Dołączony Pluginelevenlabs rejestruje Scribe v2 Realtime na potrzeby strumieniowej
transkrypcji w Voice Call oraz w trybie agenta Google Meet.
Voice Call odbiera multimedia Twilio jako dźwięk G.711 u-law o częstotliwości 8 kHz. Dostawca
usługi czasu rzeczywistego ElevenLabs domyślnie używa
ulaw_8000, dzięki czemu ramki
telefoniczne mogą być przekazywane bez transkodowania.plugins.entries.google-meet.config.realtime.transcriptionProvider na
"elevenlabs" i skonfiguruj ten sam blok dostawcy w
plugins.entries.google-meet.config.realtime.providers.elevenlabs.