/v1 compatible avec OpenAI. OpenClaw communique avec lui au moyen de l’adaptateur générique openai-completions.
inferrs est un backend personnalisé auto-hébergé compatible avec OpenAI, et non un Plugin de fournisseur OpenClaw dédié : vous le configurez sous models.providers.inferrs au lieu de sélectionner une option d’authentification lors de la configuration initiale. Pour un Plugin intégré avec détection automatique, consultez SGLang ou vLLM.Prise en main
1
Démarrer inferrs avec un modèle
2
Vérifier que le serveur est accessible
3
Ajouter une entrée de fournisseur OpenClaw
Ajoutez une entrée de fournisseur explicite et faites pointer votre modèle par défaut vers celle-ci. Consultez l’exemple de configuration ci-dessous.
Exemple de configuration complète
Gemma 4 sur un serveurinferrs local :
Démarrage à la demande
OpenClaw peut démarrerinferrs lui-même uniquement lorsqu’un modèle inferrs/... est sélectionné. Ajoutez localService à la même entrée de fournisseur :
command doit être un chemin absolu. Exécutez which inferrs sur l’hôte du Gateway et utilisez le chemin obtenu. Référence complète des champs : Services de modèles locaux.
Configuration avancée
Pourquoi requiresStringContent est important
Pourquoi requiresStringContent est important
Certaines routes Chat Completions d’
inferrs acceptent uniquement une chaîne dans messages[].content, et non des tableaux structurés de parties de contenu.Mise en garde concernant Gemma et le schéma des outils
Mise en garde concernant Gemma et le schéma des outils
Certaines combinaisons d’Cela réduit la pression exercée par le prompt sur les backends locaux plus stricts. Si les petites requêtes directes continuent de fonctionner, mais que les tours normaux de l’agent OpenClaw provoquent toujours un plantage dans
inferrs et de Gemma acceptent de petites requêtes directes vers /v1/chat/completions, mais échouent lors de tours complets de l’environnement d’exécution d’agent OpenClaw. Essayez d’abord de désactiver l’exposition du schéma des outils :inferrs, considérez qu’il s’agit d’une limitation du modèle ou du serveur en amont plutôt que d’un problème de transport OpenClaw.Test de fonctionnement manuel
Test de fonctionnement manuel
Testez les deux couches une fois la configuration terminée :Si la première commande fonctionne, mais que la seconde échoue, consultez la section Dépannage ci-dessous.
Comportement de type proxy
Comportement de type proxy
Comme
inferrs utilise l’adaptateur générique openai-completions (et non openai-responses), la mise en forme des requêtes propre à OpenAI natif ne s’applique jamais : aucun service_tier, aucun store de Responses, aucune indication de cache de prompt et aucune mise en forme de charge utile pour la compatibilité du raisonnement OpenAI ne sont envoyés.Dépannage
Échec de curl /v1/models
Échec de curl /v1/models
inferrs n’est pas en cours d’exécution, n’est pas accessible ou n’est pas lié à l’hôte ou au port que vous avez configuré. Vérifiez que le serveur est démarré et écoute à cette adresse.messages[].content attendait une chaîne
messages[].content attendait une chaîne
Définissez
compat.requiresStringContent: true dans l’entrée du modèle (voir ci-dessus).Les appels directs à /v1/chat/completions réussissent, mais openclaw infer model run échoue
Les appels directs à /v1/chat/completions réussissent, mais openclaw infer model run échoue
Définissez
compat.supportsTools: false pour désactiver l’exposition du schéma des outils (voir la mise en garde concernant Gemma ci-dessus).inferrs plante toujours lors de tours d’agent plus volumineux
inferrs plante toujours lors de tours d’agent plus volumineux
Si les erreurs de schéma ont disparu, mais qu’
inferrs plante toujours lors de tours d’agent plus volumineux, considérez qu’il s’agit d’une limitation d’inferrs ou du modèle en amont. Réduisez la pression exercée par le prompt ou changez de backend ou de modèle.Ressources connexes
Modèles locaux
Exécution d’OpenClaw avec des serveurs de modèles locaux.
Services de modèles locaux
Démarrage à la demande de serveurs de modèles locaux pour les fournisseurs configurés.
Dépannage du Gateway
Dépannage des backends locaux compatibles avec OpenAI qui réussissent les tests directs, mais échouent lors des exécutions d’agent.
Sélection du modèle
Présentation de tous les fournisseurs, des références de modèles et du comportement de basculement.