Skip to main content
openclaw infer, sağlayıcı destekli çıkarım için standart başsız yüzeydir. Ham Gateway RPC adlarını veya ajan araç kimliklerini değil, yetenek ailelerini (model, image, audio, tts, video, web, embedding) sunar. openclaw capability ..., aynı komut ağacının diğer adıdır. Tek seferlik bir sağlayıcı sarmalayıcısı yerine bunu tercih etme nedenleri:
  • OpenClaw’da önceden yapılandırılmış sağlayıcıları ve modelleri yeniden kullanır.
  • Betikler ve ajan güdümlü otomasyon için kararlı --json zarfı sunar (bkz. JSON çıktısı).
  • Çoğu alt komut için Gateway olmadan normal yerel yolu çalıştırır.
  • Uçtan uca sağlayıcı denetimlerinde, sağlayıcı isteği gönderilmeden önce yayımlanan CLI’ı, yapılandırma yüklemeyi, varsayılan ajan çözümlemesini, paketlenmiş Plugin etkinleştirmeyi ve paylaşılan yetenek çalışma zamanını sınar.

Infer’ı bir skill’e dönüştürme

Bunu kopyalayıp bir ajana yapıştırın:
Infer tabanlı iyi bir skill, yaygın kullanıcı amaçlarını doğru alt komutla eşleştirir, her iş akışı için birkaç standart örnek içerir, daha düşük seviyeli alternatifler yerine openclaw infer ... tercih eder ve skill gövdesinde infer yüzeyinin tamamını yeniden belgelemez.

Komut ağacı

infer list / infer inspect --name <capability>, bu ağacı veri olarak gösterir (yetenek kimliği, aktarımlar, açıklama).

Yaygın görevler

Davranış

  • Çıktı başka bir komuta veya betiğe aktarılacaksa --json, aksi takdirde metin çıktısı kullanın.
  • Belirli bir arka ucu sabitlemek için --provider veya --model provider/model kullanın.
  • Tek seferlik düşünme/akıl yürütme geçersiz kılması için model run --thinking <level> kullanın: off, minimal, low, medium, high, adaptive, xhigh veya max.
  • image describe, audio transcribe ve video describe için --model, <provider/model> biçimini kullanmalıdır.
  • image describe için --file, yerel yolları ve HTTP(S) URL’lerini kabul eder; uzak URL’ler normal medya getirme SSRF politikasından geçer.
  • Durumsuz yürütme komutları (model run, image *, audio *, video *, web *, embedding *) varsayılan olarak yereldir. Gateway tarafından yönetilen durum komutları (tts status) varsayılan olarak Gateway’i kullanır.
  • Yerel yol, Gateway’in çalışıyor olmasını hiçbir zaman gerektirmez.
  • Yerel model run, yalın ve tek seferlik bir sağlayıcı tamamlamasıdır: yapılandırılmış ajan modelini ve kimlik doğrulamayı çözümler ancak bir sohbet ajanı turu başlatmaz, araçları yüklemez veya paketlenmiş MCP sunucularını açmaz.
  • model run --file, görüntü dosyalarını (otomatik algılanan MIME türüyle) isteme ekler; birden fazla görüntü için --file seçeneğini yineleyin. Görüntü olmayan dosyalar reddedilir — bunun yerine infer audio transcribe veya infer video describe kullanın.
  • model run --gateway; Gateway yönlendirmesini, kaydedilmiş kimlik doğrulamayı, sağlayıcı seçimini ve gömülü çalışma zamanını sınar ancak ham model yoklaması olarak kalır: önceki oturum transkripti, önyükleme/AGENTS bağlamı, araçlar veya paketlenmiş MCP sunucuları yoktur.
  • model run --gateway --model <provider/model>, Gateway’den tek seferlik bir sağlayıcı/model geçersiz kılması çalıştırmasını istediği için güvenilir operatör Gateway kimlik bilgisi gerektirir.

Model

Metin çıkarımı ve model/sağlayıcı incelemesi.
Gateway’i başlatmadan veya ajan araç yüzeyini yüklemeden tek bir sağlayıcının hızlı çalışırlık testini yapmak için --local ile tam <provider/model> başvurularını kullanın:
Notlar:
  • Yerel model run, sağlayıcı/model/kimlik doğrulama durumuna yönelik en dar kapsamlı CLI çalışırlık testidir: ChatGPT-Codex dışındaki sağlayıcılara yalnızca verilen istemi gönderir.
  • Yerel model run --model <provider/model>, sağlayıcı yapılandırmaya yazılmadan önce paketlenmiş statik katalogdaki tam satırları (openclaw models list --all tarafından gösterilen satırların aynısını) çözümleyebilir. Sağlayıcı kimlik doğrulaması yine de gereklidir; eksik kimlik bilgileri Unknown model olarak değil, kimlik doğrulama hataları olarak başarısız olur.
  • Mistral Medium 3.5 akıl yürütme yoklamalarında sıcaklığı ayarlanmamış/varsayılan bırakın. Mistral, reasoning_effort="high" değerini temperature: 0 ile reddeder; varsayılan sıcaklığı veya 0.7 gibi sıfır olmayan bir değeri kullanın.
  • OpenAI ChatGPT/Codex OAuth (openai-chatgpt-responses API) yerel yoklamaları, aktarımın gerekli instructions alanını doldurabilmesi için asgari bir sistem talimatı ekler — tam ajan bağlamı, araçlar, bellek veya oturum transkripti eklemez.
  • model run --file, görüntü içeriğini doğrudan tek kullanıcı iletisine ekler. MIME türü image/* olarak algılandığında yaygın biçimler (PNG, JPEG, WebP) çalışır; desteklenmeyen veya tanınmayan dosyalar sağlayıcı çağrılmadan önce başarısız olur. Doğrudan çok modlu model yoklaması yerine OpenClaw’ın görüntü modeli yönlendirmesini ve geri dönüşlerini kullanmak istediğinizde infer image describe kullanın.
  • Seçilen model görüntü girdisini desteklemelidir; yalnızca metin destekleyen modeller isteği sağlayıcı katmanında reddedebilir.
  • model run --prompt, boşluk olmayan metin içermelidir; boş istemler herhangi bir sağlayıcı veya Gateway çağrısından önce reddedilir.
  • Sağlayıcı metin çıktısı döndürmediğinde yerel model run sıfır olmayan bir kodla çıkar; böylece erişilemeyen sağlayıcılar ve boş tamamlamalar başarılı yoklamalar gibi görünmez.
  • Model girdisini ham tutarken Gateway yönlendirmesini veya ajan çalışma zamanı kurulumunu test etmek için model run --gateway kullanın. Tam ajan bağlamı, araçlar, bellek ve oturum transkripti için openclaw agent veya bir sohbet yüzeyi kullanın.
  • --thinking adaptive, tamamlama çalışma zamanı düzeyindeki medium değerine eşlenir; --thinking max, yerel azami eforu destekleyen OpenAI modellerinde max değerine, aksi takdirde xhigh değerine eşlenir.
  • model auth login, model auth logout ve model auth status, kaydedilmiş sağlayıcı kimlik doğrulama durumunu yönetir.

Görüntü

Oluşturma, düzenleme ve açıklama.
Notlar:
  • Mevcut girdi dosyalarından başlarken image edit kullanın; --size, --aspect-ratio veya --resolution, bunları destekleyen sağlayıcılara/modellere geometri ipuçları ekler.
  • --output-format png --background transparent ile --model openai/gpt-image-1.5, şeffaf arka planlı OpenAI PNG çıktısı sağlar; --openai-background, aynı ipucu için OpenAI’ye özgü bir diğer addır. Arka plan desteği bildirmeyen sağlayıcılar bunu yok sayılan bir geçersiz kılma olarak raporlar (JSON zarfındaki ignoredOverrides bölümüne bakın).
  • --quality low|medium|high|auto, OpenAI dahil olmak üzere görüntü kalitesi ipuçlarını destekleyen sağlayıcılarda çalışır. OpenAI ayrıca --openai-moderation low|auto değerini de kabul eder.
  • image providers --json, paketle birlikte gelen görüntü sağlayıcılarından hangilerinin keşfedilebilir, yapılandırılmış ve seçili olduğunu ve her birinin hangi üretme/düzenleme yeteneklerini sunduğunu listeler.
  • image generate --model <provider/model> --json, görüntü üretme değişiklikleri için en dar kapsamlı canlı duman testidir:
    Yanıt; ok, provider, model, attempts ve yazılan çıktı yollarını bildirir. --output ayarlandığında son uzantı, sağlayıcının döndürdüğü MIME türüne göre belirlenebilir.
  • image describe ve image describe-many için göreve özgü bir talimat (OCR, karşılaştırma, kullanıcı arayüzü incelemesi, kısa açıklama) vermek üzere --prompt kullanın.
  • Yavaş yerel görsel modeller veya soğuk Ollama başlangıçları için --timeout-ms kullanın.
  • image describe için önce açıkça belirtilen bir --model (görüntü özellikli bir <provider/model> olmalıdır) çalıştırılır, ardından bu çağrı başarısız olursa yapılandırılmış agents.defaults.imageModel.fallbacks denenir. Girdi hazırlama hataları (eksik dosya, desteklenmeyen URL) herhangi bir geri dönüş denemesinden önce başarısız olur ve model, model kataloğunda veya sağlayıcı yapılandırmasında görüntü özellikli olmalıdır.
  • Yerel Ollama görsel modelleri için önce modeli çekin ve OLLAMA_API_KEY değerini herhangi bir yer tutucu değere, örneğin ollama-local değerine ayarlayın. Ollama bölümüne bakın.

Ses

Dosya transkripsiyonu (gerçek zamanlı oturum yönetimi değil).
--model, <provider/model> olmalıdır.

TTS

Konuşma sentezi ve TTS sağlayıcı/persona durumu.
Notlar:
  • tts status yalnızca --gateway değerini destekler (Gateway tarafından yönetilen TTS durumunu yansıtır).
  • TTS davranışını incelemek ve yapılandırmak için tts providers, tts voices, tts personas, tts set-provider ve tts set-persona kullanın.

Video

Üretme ve açıklama.
Notlar:
  • video generate; video üretme çalışma zamanına iletilen --size, --aspect-ratio, --resolution, --duration, --audio, --watermark ve --timeout-ms değerlerini kabul eder.
  • video describe için --model, <provider/model> olmalıdır.

Web

Arama ve getirme.
web providers, arama ve getirme için kullanılabilir, yapılandırılmış ve seçili sağlayıcıları listeler.

Gömme

Vektör oluşturma ve gömme sağlayıcısını inceleme.

JSON çıktısı

Infer komutları, JSON çıktısını paylaşılan bir zarf altında normalleştirir:
Kararlı üst düzey alanlar:
  • ok
  • capability
  • transport
  • provider
  • model
  • attempts
  • inputs (uygun olduğunda istekle birlikte gönderilen görüntü ekleri)
  • outputs
  • ignoredOverrides (uygun olduğunda sağlayıcının desteklemediği ipucu anahtarları)
  • error
Üretilen medya komutları için outputs, OpenClaw tarafından yazılan dosyaları içerir. Otomasyon için insan tarafından okunabilir stdout çıktısını ayrıştırmak yerine bu dizideki path, mimeType, size ve medyaya özgü boyutları kullanın.

Yaygın sorunlar

İlgili