/v1 yang kompatibel dengan OpenAI. OpenClaw terhubung ke ds4
melalui keluarga penyedia generik openai-completions.
ds4 bukan Plugin penyedia OpenClaw bawaan. Konfigurasikan di bawah
models.providers.ds4, lalu pilih ds4/deepseek-v4-flash.
Persyaratan
- macOS dengan dukungan Metal.
- Checkout ds4 yang berfungsi dengan
ds4-serverdan berkas GGUF DeepSeek V4 Flash. - Memori yang cukup untuk konteks yang Anda pilih; nilai
--ctxyang lebih besar mengalokasikan lebih banyak memori KV saat server dimulai.
Mulai cepat
1
Start ds4-server
Ganti
<DS4_DIR> dengan jalur checkout ds4 Anda.2
Verify the OpenAI-compatible endpoint
deepseek-v4-flash.3
Add the OpenClaw provider config
Tambahkan konfigurasi dari Konfigurasi lengkap, lalu jalankan pemeriksaan model
sekali jalan:
Konfigurasi lengkap
Gunakan konfigurasi ini ketika ds4 sudah berjalan di127.0.0.1:18000.
contextWindow agar selaras dengan ds4-server --ctx. Pertahankan maxTokens agar selaras
dengan --tokens, kecuali Anda memang ingin OpenClaw meminta keluaran lebih sedikit
daripada nilai bawaan server.
Memulai sesuai permintaan
OpenClaw dapat memulai ds4 hanya ketika modelds4/... dipilih. Tambahkan
localService ke entri penyedia yang sama:
command harus berupa jalur absolut ke berkas yang dapat dieksekusi. Pencarian shell dan ekspansi ~
tidak digunakan. Lihat Layanan model lokal untuk
setiap bidang localService.
Think Max
ds4 menerapkan Think Max hanya ketika kedua kondisi berikut terpenuhi:ds4-serverdimulai dengan--ctx 393216atau lebih tinggi.- Permintaan menggunakan
reasoning_effort: "max"(atau bidang tingkat upaya ds4 yang setara).
Pengujian
Pemeriksaan HTTP langsung, tanpa melalui OpenClaw:executionTrace.winnerProvideradalahds4executionTrace.winnerModeladalahdeepseek-v4-flashtoolSummary.callssetidaknya1finalAssistantVisibleTextdiawali dengantool-ok
Pemecahan masalah
curl /v1/models cannot connect
curl /v1/models cannot connect
ds4 tidak berjalan atau tidak terikat ke host/port dalam
baseUrl. Mulai
ds4-server, lalu coba lagi:500 prompt exceeds context
500 prompt exceeds context
--ctx yang dikonfigurasi terlalu kecil untuk giliran OpenClaw. Tingkatkan
ds4-server --ctx, lalu perbarui models.providers.ds4.models[].contextWindow
agar sesuai. Giliran agen penuh dengan alat memerlukan konteks yang jauh lebih besar daripada
permintaan curl langsung dengan satu pesan.Think Max does not activate
Think Max does not activate
ds4 hanya menggunakan Think Max ketika
--ctx setidaknya 393216 dan permintaan
meminta reasoning_effort: "max". Konteks yang lebih kecil akan kembali menggunakan
penalaran tingkat tinggi.The first request is slow
The first request is slow
ds4 memiliki fase awal penempatan Metal dan pemanasan model. Atur
localService.readyTimeoutMs: 300000 ketika OpenClaw memulai server sesuai
permintaan.Terkait
Local model services
Mulai server model lokal sesuai permintaan sebelum permintaan model.
Local models
Pilih dan operasikan backend model lokal.
Model providers
Konfigurasikan referensi penyedia, autentikasi, dan failover.
DeepSeek
Perilaku penyedia DeepSeek native dan kontrol pemikiran.