Skip to main content
inferrs menyajikan model lokal melalui API /v1 yang kompatibel dengan OpenAI. OpenClaw berkomunikasi dengannya melalui adaptor generik openai-completions.
inferrs adalah backend khusus yang dihosting sendiri dan kompatibel dengan OpenAI, bukan plugin penyedia khusus OpenClaw: Anda mengonfigurasikannya di models.providers.inferrs, bukan memilih opsi autentikasi orientasi awal. Untuk plugin bawaan dengan penemuan otomatis, lihat SGLang atau vLLM.

Memulai

1

Mulai inferrs dengan sebuah model

2

Pastikan server dapat dijangkau

3

Tambahkan entri penyedia OpenClaw

Tambahkan entri penyedia secara eksplisit dan arahkan model default Anda ke entri tersebut. Lihat contoh konfigurasi di bawah.

Contoh konfigurasi lengkap

Gemma 4 pada server inferrs lokal:

Penyalaan sesuai permintaan

OpenClaw dapat memulai inferrs sendiri hanya ketika model inferrs/... dipilih. Tambahkan localService ke entri penyedia yang sama:
command harus berupa jalur absolut. Jalankan which inferrs pada host Gateway dan gunakan jalur tersebut. Referensi lengkap kolom: Layanan model lokal.

Konfigurasi lanjutan

Beberapa rute Penyelesaian Percakapan inferrs hanya menerima messages[].content berupa string, bukan larik bagian konten terstruktur.
Jika proses OpenClaw gagal dengan:
tetapkan compat.requiresStringContent: true dalam entri model. OpenClaw kemudian meratakan bagian konten yang hanya berisi teks menjadi string biasa sebelum mengirim permintaan.
Beberapa kombinasi inferrs + Gemma menerima permintaan langsung berukuran kecil ke /v1/chat/completions, tetapi gagal pada putaran penuh runtime agen OpenClaw. Coba nonaktifkan permukaan skema alat terlebih dahulu:
Hal tersebut mengurangi tekanan prompt pada backend lokal yang lebih ketat. Jika permintaan langsung berukuran kecil masih berfungsi, tetapi putaran agen OpenClaw normal terus mengalami kegagalan di dalam inferrs, anggap hal itu sebagai keterbatasan model/server hulu, bukan masalah transportasi OpenClaw.
Uji kedua lapisan setelah dikonfigurasi:
Jika perintah pertama berfungsi tetapi perintah kedua gagal, lihat Pemecahan masalah di bawah.
Karena inferrs menggunakan adaptor generik openai-completions (bukan openai-responses), pembentukan permintaan yang hanya berlaku untuk OpenAI asli tidak pernah diterapkan: tidak ada service_tier, tidak ada store Responses, tidak ada petunjuk cache prompt, dan tidak ada pembentukan muatan kompatibilitas penalaran OpenAI yang dikirim.

Pemecahan masalah

inferrs tidak berjalan, tidak dapat dijangkau, atau tidak terikat ke host/port yang Anda konfigurasi. Pastikan server telah dimulai dan mendengarkan pada alamat tersebut.
Tetapkan compat.requiresStringContent: true dalam entri model (lihat di atas).
Tetapkan compat.supportsTools: false untuk menonaktifkan permukaan skema alat (lihat catatan khusus Gemma di atas).
Jika kesalahan skema telah hilang, tetapi inferrs masih mengalami kegagalan pada putaran agen yang lebih besar, anggap hal itu sebagai keterbatasan inferrs hulu atau model. Kurangi tekanan prompt atau ganti backend/model.
Untuk bantuan umum, lihat Pemecahan masalah dan Pertanyaan umum.

Terkait

Model lokal

Menjalankan OpenClaw dengan server model lokal.

Layanan model lokal

Memulai server model lokal sesuai permintaan untuk penyedia yang dikonfigurasi.

Pemecahan masalah Gateway

Men-debug backend lokal yang kompatibel dengan OpenAI, yang lolos pemeriksaan tetapi gagal menjalankan agen.

Pemilihan model

Ikhtisar semua penyedia, referensi model, dan perilaku pengalihan kegagalan.