Skip to main content
models.providers.<id>.localService는 필요할 때 공급자 소유의 로컬 모델 서버를 시작합니다. 모델 또는 임베딩 요청에서 해당 공급자를 선택하면 OpenClaw는 상태 엔드포인트를 확인하고, 서버가 중지되어 있으면 프로세스를 시작한 뒤 준비될 때까지 기다렸다가 요청을 전송합니다. 비용이 많이 드는 로컬 서버를 하루 종일 실행하지 않으려는 경우 사용하세요.

작동 방식

  1. 모델 또는 임베딩 요청이 구성된 공급자로 해석됩니다.
  2. 해당 공급자에 localService가 있으면 OpenClaw가 healthUrl을 확인합니다.
  3. 확인에 성공하면 OpenClaw는 이미 실행 중인 서버를 사용합니다.
  4. 확인에 실패하면 OpenClaw는 args를 사용하여 command를 실행합니다.
  5. OpenClaw는 readyTimeoutMs가 만료될 때까지 상태 엔드포인트를 폴링합니다.
  6. 요청은 일반적인 모델 또는 임베딩 전송 경로를 거칩니다.
  7. OpenClaw가 프로세스를 시작했고 idleStopMs가 설정되어 있으면, 처리 중이던 마지막 요청이 해당 시간만큼 유휴 상태가 된 후 프로세스를 중지합니다.
OpenClaw는 이를 위해 launchd, systemd, Docker 또는 어떠한 데몬도 설치하지 않습니다. 서버는 이를 처음 필요로 한 OpenClaw 프로세스의 일반 자식 프로세스입니다. 시작 작업은 구성된 공급자와 명령/인수/환경 변수 집합별로 직렬화되므로 동일한 서비스를 대상으로 한 채팅 및 임베딩 요청이 동시에 발생해도 서버가 중복으로 생성되지 않습니다. 각 요청은 응답 처리가 완료될 때까지 자체 임대를 유지하므로, 유휴 종료는 처리 중인 모든 모델 및 임베딩 요청이 완료될 때까지 기다립니다. 구성된 공급자 별칭은 서로 구분된 상태로 유지됩니다. 두 별칭이 서로 다른 GPU 호스트를 가리키더라도 동일한 Ollama, LM Studio 또는 OpenAI 호환 어댑터 ID로 통합되지 않습니다. 다른 OpenClaw 프로세스가 동일한 healthUrl에서 이미 정상 상태의 서버를 실행 중이면 이 프로세스는 해당 서버의 관리를 인수하지 않고 재사용합니다(각 프로세스는 자신이 직접 시작한 자식 프로세스만 관리합니다). 시작 및 종료 로그에는 길이가 제한되고 민감 정보가 제거된 자식 프로세스 출력의 마지막 부분과 소요 시간 및 종료 세부 정보가 포함되며, 구성된 환경 변수 값은 절대 출력되지 않습니다.

구성 형태

느린 콜드 스타트와 긴 생성 작업이 기본 모델 요청 제한 시간에 걸리지 않도록 공급자 항목에 timeoutSeconds를 설정하세요(localService가 아님). 서버가 기본 URL의 /models가 아닌 다른 위치에서 준비 상태를 제공하는 경우에는 명시적인 healthUrl을 설정하세요.

필드

Inferrs 예시

Inferrs는 사용자 지정 OpenAI 호환 /v1 백엔드이므로 동일한 localService API를 inferrs 공급자 항목에 사용할 수 있습니다.
command를 OpenClaw가 실행되는 머신에서 which inferrs를 실행한 결과로 바꾸세요. 전체 inferrs 설정: Inferrs.

ds4 예시

전체 설정, 컨텍스트 크기 조정 및 검증 명령: ds4.

관련 항목

로컬 모델

로컬 모델 설정, 공급자 선택 및 안전 지침입니다.

Inferrs

inferrs OpenAI 호환 로컬 서버를 통해 OpenClaw를 실행합니다.