Skip to main content
Hugging Face Inference Providers stellt einen OpenAI-kompatiblen Router für Chat Completions bereit, der mit einem einzigen Token den Zugriff auf zahlreiche gehostete Modelle (DeepSeek, Llama und weitere) ermöglicht. OpenClaw kommuniziert ausschließlich mit dem Chat-Completions-Endpunkt; für Text-zu-Bild, Embeddings oder Sprache verwenden Sie direkt die HF-Inferenzclients.

Erste Schritte

1

Ein feingranulares Token erstellen

Rufen Sie Hugging Face Settings Tokens auf und erstellen Sie ein neues feingranulares Token.
Für das Token muss die Berechtigung Make calls to Inference Providers aktiviert sein, andernfalls werden API-Anfragen abgelehnt.
2

Onboarding ausführen

Wählen Sie im Provider-Dropdown Hugging Face aus und geben Sie anschließend bei Aufforderung Ihren API-Schlüssel ein:
3

Ein Standardmodell auswählen

Wählen Sie im Dropdown Default Hugging Face model ein Modell aus. Bei einem gültigen Token wird die Liste aus der Inference API geladen; andernfalls zeigt OpenClaw den unten aufgeführten integrierten Katalog an. Ihre Auswahl wird als agents.defaults.model.primary gespeichert:
4

Verfügbarkeit des Modells überprüfen

Nicht interaktive Einrichtung

Legt huggingface/deepseek-ai/DeepSeek-R1 als Standardmodell fest.

Modell-IDs

Modellreferenzen verwenden die Form huggingface/<org>/<model> (IDs im Hub-Stil). Der integrierte Katalog von OpenClaw:
Wenn Ihr Token gültig ist, erkennt OpenClaw beim Onboarding und beim Start des Gateway außerdem alle weiteren Modelle über GET https://router.huggingface.co/v1/models, sodass Ihr Katalog weit mehr als die drei oben aufgeführten Modelle enthalten kann. Sie können an jede Modell-ID :fastest oder :cheapest anhängen; der HF-Router leitet die Anfrage an den entsprechenden Inferenz-Provider weiter. Legen Sie Ihre standardmäßige Provider-Reihenfolge in den Inference Provider settings fest.

Erweiterte Konfiguration

OpenClaw erkennt Modelle mit:
Die Antwort entspricht dem OpenAI-Stil: { "object": "list", "data": [ { "id": "Qwen/Qwen3-8B", "owned_by": "Qwen", ... }, ... ] }.Mit einem konfigurierten Schlüssel (Onboarding, HUGGINGFACE_HUB_TOKEN oder HF_TOKEN) wird das Dropdown Default Hugging Face model während der interaktiven Einrichtung über diesen Endpunkt befüllt. Beim Start des Gateway wird derselbe Aufruf wiederholt, um den Katalog zu aktualisieren. Erkannte Modelle werden mit dem oben aufgeführten integrierten Katalog zusammengeführt, der bei übereinstimmender ID für Metadaten wie Kontextfenster und Kosten verwendet wird. Wenn die Anfrage fehlschlägt, keine Daten zurückgibt oder kein Schlüssel festgelegt ist, verwendet OpenClaw ausschließlich den integrierten Katalog.So deaktivieren Sie die Erkennung, ohne den Provider zu entfernen:
  • Name aus der API: Erkannte Modelle verwenden, sofern vorhanden, name, title oder display_name aus der API; andernfalls leitet OpenClaw aus der Modell-ID einen Namen ab (beispielsweise wird deepseek-ai/DeepSeek-R1 zu „DeepSeek R1“).
  • Anzeigenamen überschreiben: Legen Sie in der Konfiguration für jedes Modell eine benutzerdefinierte Bezeichnung fest:
  • Richtliniensuffixe: :fastest und :cheapest sind Konventionen des HF-Routers und werden nicht von OpenClaw umgeschrieben: Das Suffix wird unverändert als Teil der Modell-ID gesendet, und der HF-Router wählt den entsprechenden Inferenz-Provider aus. Fügen Sie jede Variante als eigenen Eintrag unter models.providers.huggingface.models (oder in model.primary) hinzu, wenn Sie für jedes Suffix einen eigenen Alias verwenden möchten.
  • Zusammenführung der Konfiguration: Vorhandene Einträge in models.providers.huggingface.models (beispielsweise in models.json) bleiben bei der Zusammenführung der Konfiguration erhalten. Dadurch bleiben alle benutzerdefinierten name, alias oder Modelloptionen, die Sie dort festlegen, über Neustarts hinweg erhalten.
Wenn das Gateway als Daemon (launchd/systemd) ausgeführt wird, stellen Sie sicher, dass HUGGINGFACE_HUB_TOKEN oder HF_TOKEN für diesen Prozess verfügbar ist (beispielsweise in ~/.openclaw/.env oder über env.shellEnv).
OpenClaw akzeptiert sowohl HUGGINGFACE_HUB_TOKEN als auch HF_TOKEN. Wenn beide festgelegt sind, hat HUGGINGFACE_HUB_TOKEN Vorrang.

Verwandte Themen

Modellauswahl

Übersicht über alle Provider, Modellreferenzen und das Failover-Verhalten.

Modellauswahl

So wählen und konfigurieren Sie Modelle.

Dokumentation zu Inference Providers

Offizielle Dokumentation zu Hugging Face Inference Providers.

Konfiguration

Vollständige Konfigurationsreferenz.