Skip to main content
models.providers.<id>.localService memulai server model lokal milik penyedia sesuai permintaan. Ketika permintaan model atau embedding memilih penyedia tersebut, OpenClaw memeriksa endpoint kesehatan, memulai proses jika tidak aktif, menunggu hingga siap, lalu mengirimkan permintaan. Gunakan fitur ini agar server lokal yang mahal tidak perlu terus berjalan sepanjang hari.

Cara kerjanya

  1. Permintaan model atau embedding diarahkan ke penyedia yang dikonfigurasi.
  2. Jika penyedia tersebut memiliki localService, OpenClaw memeriksa healthUrl.
  3. Jika pemeriksaan berhasil, OpenClaw menggunakan server yang sudah berjalan.
  4. Jika pemeriksaan gagal, OpenClaw menjalankan command dengan args.
  5. OpenClaw melakukan polling pada endpoint kesehatan hingga readyTimeoutMs berakhir.
  6. Permintaan diteruskan melalui transport model atau embedding yang normal.
  7. Jika OpenClaw memulai proses dan idleStopMs ditetapkan, OpenClaw menghentikan proses setelah permintaan aktif terakhir menganggur selama durasi tersebut.
OpenClaw tidak memasang launchd, systemd, Docker, atau daemon apa pun untuk ini. Server merupakan proses anak biasa dari proses OpenClaw yang pertama kali membutuhkannya. Proses mulai diserialkan untuk setiap kombinasi penyedia serta perintah/argumen/lingkungan yang dikonfigurasi, sehingga permintaan obrolan dan embedding bersamaan untuk layanan yang sama tidak memulai server duplikat. Setiap permintaan mempertahankan sewanya sendiri hingga penanganan respons selesai, sehingga penghentian saat menganggur menunggu setiap permintaan model dan embedding yang sedang berlangsung. Alias penyedia yang dikonfigurasi tetap berbeda: dua alias dapat mengarah ke host GPU yang berbeda tanpa digabungkan ke id adaptor Ollama, LM Studio, atau yang kompatibel dengan OpenAI yang sama. Jika proses OpenClaw lain sudah memiliki server yang sehat pada healthUrl yang sama, proses ini menggunakannya kembali tanpa mengambil alih pengelolaannya (setiap proses hanya mengelola proses anak yang dimulainya sendiri). Log mulai dan keluar menyertakan bagian akhir keluaran proses anak yang dibatasi dan disunting, beserta detail waktu dan keluarnya proses; nilai lingkungan yang dikonfigurasi tidak pernah ditampilkan.

Bentuk konfigurasi

Tetapkan timeoutSeconds pada entri penyedia (bukan localService) agar proses mulai dingin yang lambat dan pembuatan keluaran yang panjang tidak mencapai batas waktu default permintaan model. Tetapkan healthUrl secara eksplisit setiap kali server Anda menyediakan status kesiapan di lokasi selain /models pada URL dasar.

Bidang

Contoh Inferrs

Inferrs adalah backend /v1 khusus yang kompatibel dengan OpenAI, sehingga API localService yang sama dapat digunakan dengan entri penyedia inferrs:
Ganti command dengan hasil which inferrs pada mesin yang menjalankan OpenClaw. Penyiapan lengkap inferrs: Inferrs.

Contoh ds4

Perintah penyiapan lengkap, penentuan ukuran konteks, dan verifikasi: ds4.

Terkait

Model lokal

Penyiapan model lokal, pilihan penyedia, dan panduan keamanan.

Inferrs

Jalankan OpenClaw melalui server lokal inferrs yang kompatibel dengan OpenAI.