Skip to main content
Hugging Face Inference Providers menyediakan router penyelesaian chat yang kompatibel dengan OpenAI untuk banyak model yang di-host (DeepSeek, Llama, dan lainnya) dengan satu token. OpenClaw hanya berkomunikasi dengan endpoint penyelesaian chat; untuk teks-ke-gambar, embedding, atau ucapan, gunakan klien inferensi HF secara langsung.

Memulai

1

Buat token terperinci

Buka Hugging Face Settings Tokens dan buat token terperinci baru.
Token harus mengaktifkan izin Make calls to Inference Providers atau permintaan API akan ditolak.
2

Jalankan orientasi awal

Pilih Hugging Face dalam daftar tarik-turun penyedia, lalu masukkan kunci API saat diminta:
3

Pilih model default

Dalam daftar tarik-turun Default Hugging Face model, pilih model. Daftar dimuat dari Inference API saat token Anda valid; jika tidak, OpenClaw menampilkan katalog bawaan di bawah. Pilihan Anda disimpan sebagai agents.defaults.model.primary:
4

Verifikasi bahwa model tersedia

Penyiapan noninteraktif

Menetapkan huggingface/deepseek-ai/DeepSeek-R1 sebagai model default.

ID model

Referensi model menggunakan format huggingface/<org>/<model> (ID bergaya Hub). Katalog bawaan OpenClaw:
Saat token Anda valid, OpenClaw juga menemukan model lain dari GET https://router.huggingface.co/v1/models pada saat orientasi awal dan Gateway dimulai, sehingga katalog Anda dapat memuat jauh lebih banyak daripada tiga model di atas. Anda dapat menambahkan :fastest atau :cheapest ke ID model apa pun; router HF merutekannya ke penyedia inferensi yang cocok. Atur urutan penyedia default Anda di pengaturan Inference Provider.

Konfigurasi lanjutan

OpenClaw menemukan model dengan:
Responsnya bergaya OpenAI: { "object": "list", "data": [ { "id": "Qwen/Qwen3-8B", "owned_by": "Qwen", ... }, ... ] }.Dengan kunci yang dikonfigurasi (orientasi awal, HUGGINGFACE_HUB_TOKEN, atau HF_TOKEN), daftar tarik-turun Default Hugging Face model selama penyiapan interaktif diisi dari endpoint ini. Saat Gateway dimulai, panggilan yang sama diulangi untuk menyegarkan katalog. Model yang ditemukan digabungkan dengan katalog bawaan di atas (digunakan untuk metadata seperti jendela konteks dan biaya saat ID cocok). Jika permintaan gagal, tidak mengembalikan data, atau tidak ada kunci yang ditetapkan, OpenClaw hanya kembali menggunakan katalog bawaan.Nonaktifkan penemuan tanpa menghapus penyedia:
  • Nama dari API: model yang ditemukan menggunakan name, title, atau display_name dari API jika tersedia; jika tidak, OpenClaw memperoleh nama dari ID model (misalnya deepseek-ai/DeepSeek-R1 menjadi “DeepSeek R1”).
  • Timpa nama tampilan: tetapkan label khusus per model dalam konfigurasi:
  • Sufiks kebijakan: :fastest dan :cheapest adalah konvensi router HF, bukan sesuatu yang ditulis ulang oleh OpenClaw: sufiks dikirim apa adanya sebagai bagian dari ID model dan router HF memilih penyedia inferensi yang cocok. Tambahkan setiap varian sebagai entrinya sendiri di bawah models.providers.huggingface.models (atau dalam model.primary) jika Anda menginginkan alias yang berbeda untuk setiap sufiks.
  • Penggabungan konfigurasi: entri yang sudah ada dalam models.providers.huggingface.models (misalnya dalam models.json) dipertahankan saat konfigurasi digabungkan, sehingga name, alias, atau opsi model khusus apa pun yang Anda tetapkan di sana tetap ada setelah dimulai ulang.
Jika Gateway berjalan sebagai daemon (launchd/systemd), pastikan HUGGINGFACE_HUB_TOKEN atau HF_TOKEN tersedia untuk proses tersebut (misalnya, dalam ~/.openclaw/.env atau melalui env.shellEnv).
OpenClaw menerima HUGGINGFACE_HUB_TOKEN dan HF_TOKEN. Jika keduanya ditetapkan, HUGGINGFACE_HUB_TOKEN lebih diprioritaskan.

Terkait

Pemilihan model

Ikhtisar semua penyedia, referensi model, dan perilaku failover.

Pemilihan model

Cara memilih dan mengonfigurasi model.

Dokumentasi Inference Providers

Dokumentasi resmi Hugging Face Inference Providers.

Konfigurasi

Referensi konfigurasi lengkap.