Skip to main content
models.providers.<id>.localService uruchamia na żądanie lokalny serwer modeli zarządzany przez dostawcę. Gdy żądanie modelu lub osadzania wybierze tego dostawcę, OpenClaw sprawdza punkt końcowy kondycji, uruchamia proces, jeśli serwer nie działa, czeka na gotowość, a następnie wysyła żądanie. Użyj tej funkcji, aby uniknąć utrzymywania kosztownych lokalnych serwerów przez cały dzień.

Jak to działa

  1. Żądanie modelu lub osadzania jest kierowane do skonfigurowanego dostawcy.
  2. Jeśli ten dostawca ma localService, OpenClaw sprawdza healthUrl.
  3. Po pomyślnym sprawdzeniu OpenClaw używa już działającego serwera.
  4. Po nieudanym sprawdzeniu OpenClaw uruchamia command z argumentami args.
  5. OpenClaw cyklicznie sprawdza punkt końcowy kondycji do upłynięcia readyTimeoutMs.
  6. Żądanie jest obsługiwane przez standardowy transport modelu lub osadzania.
  7. Jeśli OpenClaw uruchomił proces i ustawiono idleStopMs, zatrzymuje go, gdy od zakończenia ostatniego aktywnego żądania upłynie określony czas bezczynności.
OpenClaw nie instaluje w tym celu launchd, systemd, Dockera ani żadnego demona. Serwer jest zwykłym procesem potomnym tego procesu OpenClaw, który jako pierwszy go potrzebował. Uruchamianie jest serializowane dla każdej kombinacji skonfigurowanego dostawcy, polecenia, argumentów i zmiennych środowiskowych, więc równoczesne żądania czatu i osadzania kierowane do tej samej usługi nie uruchamiają zduplikowanych serwerów. Każde żądanie zachowuje własną dzierżawę do zakończenia obsługi odpowiedzi, dlatego wyłączenie po okresie bezczynności czeka na zakończenie wszystkich aktywnych żądań modeli i osadzania. Skonfigurowane aliasy dostawców pozostają odrębne: dwa aliasy mogą wskazywać różne hosty GPU bez łączenia ich w ten sam identyfikator adaptera Ollama, LM Studio lub zgodnego z OpenAI. Jeśli inny proces OpenClaw ma już sprawny serwer pod tym samym adresem healthUrl, bieżący proces używa go ponownie bez przejmowania nad nim kontroli (każdy proces zarządza wyłącznie procesem potomnym, który sam uruchomił). Dzienniki uruchamiania i zakończenia zawierają ograniczone, zredagowane końcowe fragmenty danych wyjściowych procesu potomnego oraz szczegóły czasu i zakończenia; skonfigurowane wartości środowiskowe nigdy nie są ujawniane.

Struktura konfiguracji

Ustaw timeoutSeconds we wpisie dostawcy (nie w localService), aby powolne uruchamianie na zimno i długie generowanie nie przekraczały domyślnego limitu czasu żądania modelu. Ustaw jawny adres healthUrl, jeśli serwer udostępnia stan gotowości w innym miejscu niż /models względem bazowego adresu URL.

Pola

Przykład Inferrs

Inferrs to niestandardowe zaplecze /v1 zgodne z OpenAI, więc ten sam interfejs API localService działa z wpisem dostawcy inferrs:
Zastąp command wynikiem polecenia which inferrs na komputerze, na którym działa OpenClaw. Pełna konfiguracja inferrs: Inferrs.

Przykład ds4

Pełna konfiguracja, dobór rozmiaru kontekstu i polecenia weryfikacyjne: ds4.

Powiązane materiały

Modele lokalne

Konfiguracja modeli lokalnych, wybór dostawców i wskazówki dotyczące bezpieczeństwa.

Inferrs

Uruchamianie OpenClaw za pośrednictwem lokalnego serwera inferrs zgodnego z OpenAI.