Skip to main content
ds4 menyajikan DeepSeek V4 Flash dari backend Metal lokal dengan API /v1 yang kompatibel dengan OpenAI. OpenClaw terhubung ke ds4 melalui keluarga penyedia generik openai-completions. ds4 bukan Plugin penyedia OpenClaw bawaan. Konfigurasikan di bawah models.providers.ds4, lalu pilih ds4/deepseek-v4-flash.

Persyaratan

  • macOS dengan dukungan Metal.
  • Checkout ds4 yang berfungsi dengan ds4-server dan berkas GGUF DeepSeek V4 Flash.
  • Memori yang cukup untuk konteks yang Anda pilih; nilai --ctx yang lebih besar mengalokasikan lebih banyak memori KV saat server dimulai.
Giliran agen OpenClaw menyertakan skema alat dan konteks ruang kerja. Konteks kecil seperti --ctx 4096 dapat lolos pengujian curl langsung, tetapi gagal saat menjalankan agen penuh dengan 500 prompt exceeds context. Gunakan setidaknya --ctx 32768 untuk pengujian asap agen dan alat. Gunakan --ctx 393216 hanya jika tersedia cukup memori dan untuk mengaktifkan ds4 Think Max.

Mulai cepat

1

Start ds4-server

Ganti <DS4_DIR> dengan jalur checkout ds4 Anda.
2

Verify the OpenAI-compatible endpoint

Respons harus menyertakan deepseek-v4-flash.
3

Add the OpenClaw provider config

Tambahkan konfigurasi dari Konfigurasi lengkap, lalu jalankan pemeriksaan model sekali jalan:

Konfigurasi lengkap

Gunakan konfigurasi ini ketika ds4 sudah berjalan di 127.0.0.1:18000.
Pertahankan contextWindow agar selaras dengan ds4-server --ctx. Pertahankan maxTokens agar selaras dengan --tokens, kecuali Anda memang ingin OpenClaw meminta keluaran lebih sedikit daripada nilai bawaan server.

Memulai sesuai permintaan

OpenClaw dapat memulai ds4 hanya ketika model ds4/... dipilih. Tambahkan localService ke entri penyedia yang sama:
command harus berupa jalur absolut ke berkas yang dapat dieksekusi. Pencarian shell dan ekspansi ~ tidak digunakan. Lihat Layanan model lokal untuk setiap bidang localService.

Think Max

ds4 menerapkan Think Max hanya ketika kedua kondisi berikut terpenuhi:
  • ds4-server dimulai dengan --ctx 393216 atau lebih tinggi.
  • Permintaan menggunakan reasoning_effort: "max" (atau bidang tingkat upaya ds4 yang setara).
Jika Anda menjalankan konteks sebesar itu, perbarui flag server dan metadata model OpenClaw:

Pengujian

Pemeriksaan HTTP langsung, tanpa melalui OpenClaw:
Perutean model OpenClaw (sama seperti pemeriksaan Mulai cepat):
Pengujian asap agen penuh dan panggilan alat, dengan konteks setidaknya 32768:
Hasil yang diharapkan:
  • executionTrace.winnerProvider adalah ds4
  • executionTrace.winnerModel adalah deepseek-v4-flash
  • toolSummary.calls setidaknya 1
  • finalAssistantVisibleText diawali dengan tool-ok

Pemecahan masalah

ds4 tidak berjalan atau tidak terikat ke host/port dalam baseUrl. Mulai ds4-server, lalu coba lagi:
--ctx yang dikonfigurasi terlalu kecil untuk giliran OpenClaw. Tingkatkan ds4-server --ctx, lalu perbarui models.providers.ds4.models[].contextWindow agar sesuai. Giliran agen penuh dengan alat memerlukan konteks yang jauh lebih besar daripada permintaan curl langsung dengan satu pesan.
ds4 hanya menggunakan Think Max ketika --ctx setidaknya 393216 dan permintaan meminta reasoning_effort: "max". Konteks yang lebih kecil akan kembali menggunakan penalaran tingkat tinggi.
ds4 memiliki fase awal penempatan Metal dan pemanasan model. Atur localService.readyTimeoutMs: 300000 ketika OpenClaw memulai server sesuai permintaan.

Terkait

Local model services

Mulai server model lokal sesuai permintaan sebelum permintaan model.

Local models

Pilih dan operasikan backend model lokal.

Model providers

Konfigurasikan referensi penyedia, autentikasi, dan failover.

DeepSeek

Perilaku penyedia DeepSeek native dan kontrol pemikiran.