Skip to main content
NVIDIA menyediakan model terbuka secara gratis melalui API yang kompatibel dengan OpenAI di https://integrate.api.nvidia.com/v1, yang diautentikasi dengan kunci API dari build.nvidia.com. OpenClaw menetapkan Nemotron 3 Ultra sebagai model bawaan penyedia NVIDIA, yaitu model penalaran NVIDIA dengan total 550B parameter / 55B parameter aktif untuk tugas agen dengan konteks panjang.

Memulai

1

Dapatkan kunci API Anda

Buat kunci API di build.nvidia.com.
2

Ekspor kunci dan jalankan orientasi awal

3

Tetapkan model NVIDIA

Untuk penyiapan noninteraktif, berikan kunci secara langsung:
--nvidia-api-key menyimpan kunci dalam riwayat shell dan keluaran ps. Jika memungkinkan, gunakan variabel lingkungan NVIDIA_API_KEY.

Contoh konfigurasi

Katalog unggulan

Saat kunci API NVIDIA dikonfigurasi, alur penyiapan dan pemilihan model mengambil katalog publik model unggulan NVIDIA dari https://assets.ngc.nvidia.com/products/api-catalog/featured-models.json dan menyimpan hasilnya dalam cache selama 24 jam (32 entri pertama, diimpor sebagai baris masukan teks gratis). Karena itu, model unggulan baru dari build.nvidia.com akan muncul pada antarmuka penyiapan dan pemilihan model tanpa harus menunggu rilis OpenClaw. Saat umpan langsung tersedia, model pertama yang dikembalikan menjadi opsi yang telah dipilih sebelumnya selama penyiapan NVIDIA. Pengambilan menggunakan kebijakan host HTTPS tetap untuk assets.ngc.nvidia.com. Jika tidak ada kunci API NVIDIA yang dikonfigurasi, atau jika umpan tidak tersedia atau berformat tidak valid, OpenClaw kembali menggunakan katalog bawaan dan model bawaan di bawah ini.

Nemotron 3 Ultra

Nemotron 3 Ultra adalah model NVIDIA bawaan di OpenClaw. Halaman build NVIDIA untuk nvidia/nemotron-3-ultra-550b-a55b mencantumkannya sebagai titik akhir gratis yang tersedia dengan spesifikasi konteks 1 juta token. Baris Ultra bawaan mengirim chat_template_kwargs: { enable_thinking: false, force_nonempty_content: true } secara bawaan agar keluaran percakapan biasa tetap berada dalam jawaban yang terlihat dan tidak menampilkan teks penalaran. Gunakan Ultra sebagai model bawaan NVIDIA dengan kemampuan tertinggi. Tetap pilih Super jika Anda menginginkan opsi Nemotron 3 yang lebih kecil, atau pilih salah satu model pihak ketiga yang dihosting dalam katalog NVIDIA jika konteks, latensi, atau perilakunya lebih sesuai.

Katalog cadangan bawaan

Baris bawaan yang dapat dipilih merupakan cuplikan katalog model unggulan NVIDIA. Baris kompatibilitas yang sudah tidak digunakan tetap dapat diakses melalui referensi persis, tetapi tidak ditampilkan dalam pemilih model. Katalog kompatibilitas lengkap juga mempertahankan referensi yang telah dirilis berikut untuk konfigurasi yang sudah ada: nvidia/moonshotai/kimi-k2.5, nvidia/z-ai/glm-5.1, nvidia/minimaxai/minimax-m2.5, nvidia/z-ai/glm5, dan nvidia/minimaxai/minimax-m2.7. Model tersebut tetap tersedia melalui referensi persis, tetapi tidak pernah muncul dalam orientasi awal atau pemilih model.

Konfigurasi lanjutan

Penyedia diaktifkan secara otomatis saat variabel lingkungan NVIDIA_API_KEY ditetapkan atau kunci disimpan selama orientasi awal. Tidak diperlukan konfigurasi penyedia secara eksplisit selain kunci tersebut.
OpenClaw mengutamakan katalog publik model unggulan NVIDIA saat autentikasi NVIDIA dikonfigurasi dan menyimpannya dalam cache selama 24 jam. Cadangan bawaan yang dapat dipilih merupakan cuplikan statis katalog model unggulan NVIDIA; baris kompatibilitas dengan referensi persis yang sudah tidak digunakan disembunyikan dari pemilih model. Biaya secara bawaan ditetapkan ke 0 dalam kode sumber karena NVIDIA saat ini menawarkan akses API gratis untuk model yang tercantum.
OpenClaw berkomunikasi dengan NVIDIA menggunakan adaptor openai-completions melalui rute penyelesaian percakapan standar /v1. Peralatan apa pun yang kompatibel dengan OpenAI seharusnya langsung berfungsi dengan URL dasar NVIDIA.
Contoh permintaan Ultra dari NVIDIA menggunakan chat_template_kwargs.enable_thinking dan reasoning_budget untuk keluaran penalaran. Baris Ultra bawaan OpenClaw secara bawaan menonaktifkan penalaran templat untuk penggunaan percakapan biasa. Jika Anda perlu mengaktifkan keluaran penalaran NVIDIA atau memaksakan kolom permintaan khusus NVIDIA lainnya, tetapkan parameter per model dan batasi penggantian khusus penyedia hanya untuk model NVIDIA:
params.chat_template_kwargs digabungkan ke dalam chat_template_kwargs yang sudah ada pada permintaan, alih-alih mengganti seluruh objek. params.extra_body adalah penggantian akhir isi permintaan yang kompatibel dengan OpenAI dan akan menimpa kunci muatan yang bertabrakan, jadi gunakan hanya untuk kolom yang didokumentasikan NVIDIA bagi titik akhir yang dipilih.
Beberapa model khusus yang dihosting NVIDIA dapat memerlukan waktu lebih lama daripada pengawas waktu menganggur model bawaan sekitar 120 detik sebelum mengirim potongan respons pertama. Untuk entri penyedia NVIDIA khusus, tingkatkan batas waktu penyedia, bukan batas waktu seluruh lingkungan eksekusi agen; timeoutSeconds mencakup permintaan HTTP penyedia dan meningkatkan batas pengawas waktu menganggur/aliran untuk penyedia tersebut:
Model NVIDIA saat ini dapat digunakan secara gratis. Periksa build.nvidia.com untuk ketersediaan terbaru dan detail batas laju.

Terkait

Pemilihan model

Memilih penyedia, referensi model, dan perilaku pengalihan saat gagal.

Referensi konfigurasi

Referensi konfigurasi lengkap untuk agen, model, dan penyedia.