Skip to main content
Hugging Face Inference Providers는 하나의 토큰으로 여러 호스팅 모델(DeepSeek, Llama 등)을 이용할 수 있도록 OpenAI 호환 채팅 완성 라우터를 제공합니다. OpenClaw는 채팅 완성 엔드포인트만 사용합니다. 텍스트-이미지 변환, 임베딩 또는 음성 기능에는 HF 추론 클라이언트를 직접 사용하세요.

시작하기

1

세분화된 토큰 만들기

Hugging Face Settings Tokens로 이동하여 새로운 세분화된 토큰을 만드세요.
토큰에 Make calls to Inference Providers 권한을 활성화해야 합니다. 그렇지 않으면 API 요청이 거부됩니다.
2

온보딩 실행

제공자 드롭다운에서 Hugging Face를 선택한 다음, 메시지가 표시되면 API 키를 입력하세요.
3

기본 모델 선택

기본 Hugging Face 모델 드롭다운에서 모델을 선택하세요. 토큰이 유효하면 추론 API에서 목록을 불러오고, 그렇지 않으면 OpenClaw가 아래의 내장 카탈로그를 표시합니다. 선택한 항목은 agents.defaults.model.primary로 저장됩니다.
4

모델 사용 가능 여부 확인

비대화형 설정

huggingface/deepseek-ai/DeepSeek-R1을 기본 모델로 설정합니다.

모델 ID

모델 참조는 huggingface/<org>/<model> 형식(Hub 스타일 ID)을 사용합니다. OpenClaw의 내장 카탈로그는 다음과 같습니다.
토큰이 유효하면 OpenClaw는 온보딩 시점과 Gateway 시작 시 GET https://router.huggingface.co/v1/models에서 다른 모든 모델도 검색하므로, 카탈로그에 위의 네 모델보다 훨씬 많은 모델을 포함할 수 있습니다. 모든 모델 ID에 :fastest 또는 :cheapest를 추가할 수 있으며, HF 라우터가 조건에 맞는 추론 제공자로 라우팅합니다. 추론 제공자 설정에서 기본 제공자 순서를 설정하세요.

고급 구성

OpenClaw는 다음 요청으로 모델을 검색합니다.
응답은 OpenAI 형식입니다. { "object": "list", "data": [ { "id": "Qwen/Qwen3-8B", "owned_by": "Qwen", ... }, ... ] }.구성된 키(온보딩, HUGGINGFACE_HUB_TOKEN 또는 HF_TOKEN)가 있으면 대화형 설정 중 기본 Hugging Face 모델 드롭다운이 이 엔드포인트의 데이터로 채워집니다. Gateway를 시작할 때 카탈로그를 새로 고치기 위해 동일한 호출을 반복합니다. 검색된 모델은 위의 내장 카탈로그와 병합됩니다. ID가 일치하면 컨텍스트 창 및 비용과 같은 메타데이터에 내장 카탈로그가 사용됩니다. 요청이 실패하거나 데이터가 반환되지 않거나 키가 설정되지 않은 경우 OpenClaw는 내장 카탈로그만 사용합니다.제공자를 제거하지 않고 검색을 비활성화하려면 다음을 실행하세요.
  • API의 이름: 검색된 모델은 API에 name, title 또는 display_name이 있으면 해당 값을 사용합니다. 그렇지 않으면 OpenClaw가 모델 ID에서 이름을 생성합니다(예: deepseek-ai/DeepSeek-R1은 “DeepSeek R1”이 됨).
  • 표시 이름 재정의: 구성에서 모델별 사용자 지정 레이블을 설정하세요.
  • 정책 접미사: :fastest:cheapest는 HF 라우터 규칙이며 OpenClaw가 재작성하는 값이 아닙니다. 접미사는 모델 ID의 일부로 그대로 전송되고, HF 라우터가 조건에 맞는 추론 제공자를 선택합니다. 접미사별로 서로 다른 별칭을 사용하려면 각 변형을 models.providers.huggingface.models 아래(또는 model.primary)에 별도의 항목으로 추가하세요.
  • 구성 병합: models.providers.huggingface.models의 기존 항목(예: models.json의 항목)은 구성 병합 시 유지되므로, 여기에서 설정한 사용자 지정 name, alias 또는 모델 옵션은 다시 시작해도 유지됩니다.
Gateway가 데몬(launchd/systemd)으로 실행되는 경우 해당 프로세스에서 HUGGINGFACE_HUB_TOKEN 또는 HF_TOKEN을 사용할 수 있는지 확인하세요(예: ~/.openclaw/.env 또는 env.shellEnv 사용).
OpenClaw는 HUGGINGFACE_HUB_TOKENHF_TOKEN을 모두 지원합니다. 둘 다 설정된 경우 HUGGINGFACE_HUB_TOKEN이 우선합니다.

관련 항목

모델 선택

모든 제공자, 모델 참조 및 장애 조치 동작을 개괄합니다.

모델 선택

모델을 선택하고 구성하는 방법을 설명합니다.

추론 제공자 문서

공식 Hugging Face Inference Providers 문서입니다.

구성

전체 구성 참조입니다.