Skip to main content
inferrs expose des modèles locaux derrière une API /v1 compatible avec OpenAI. OpenClaw communique avec lui au moyen de l’adaptateur générique openai-completions.
inferrs est un backend personnalisé auto-hébergé compatible avec OpenAI, et non un Plugin de fournisseur OpenClaw dédié : vous le configurez sous models.providers.inferrs au lieu de sélectionner une option d’authentification lors de la configuration initiale. Pour un Plugin intégré avec détection automatique, consultez SGLang ou vLLM.

Prise en main

1

Démarrer inferrs avec un modèle

2

Vérifier que le serveur est accessible

3

Ajouter une entrée de fournisseur OpenClaw

Ajoutez une entrée de fournisseur explicite et faites pointer votre modèle par défaut vers celle-ci. Consultez l’exemple de configuration ci-dessous.

Exemple de configuration complète

Gemma 4 sur un serveur inferrs local :

Démarrage à la demande

OpenClaw peut démarrer inferrs lui-même uniquement lorsqu’un modèle inferrs/... est sélectionné. Ajoutez localService à la même entrée de fournisseur :
command doit être un chemin absolu. Exécutez which inferrs sur l’hôte du Gateway et utilisez le chemin obtenu. Référence complète des champs : Services de modèles locaux.

Configuration avancée

Certaines routes Chat Completions d’inferrs acceptent uniquement une chaîne dans messages[].content, et non des tableaux structurés de parties de contenu.
Si les exécutions OpenClaw échouent avec :
définissez compat.requiresStringContent: true dans l’entrée du modèle. OpenClaw convertit alors les parties de contenu composées uniquement de texte en chaînes simples avant d’envoyer la requête.
Certaines combinaisons d’inferrs et de Gemma acceptent de petites requêtes directes vers /v1/chat/completions, mais échouent lors de tours complets de l’environnement d’exécution d’agent OpenClaw. Essayez d’abord de désactiver l’exposition du schéma des outils :
Cela réduit la pression exercée par le prompt sur les backends locaux plus stricts. Si les petites requêtes directes continuent de fonctionner, mais que les tours normaux de l’agent OpenClaw provoquent toujours un plantage dans inferrs, considérez qu’il s’agit d’une limitation du modèle ou du serveur en amont plutôt que d’un problème de transport OpenClaw.
Testez les deux couches une fois la configuration terminée :
Si la première commande fonctionne, mais que la seconde échoue, consultez la section Dépannage ci-dessous.
Comme inferrs utilise l’adaptateur générique openai-completions (et non openai-responses), la mise en forme des requêtes propre à OpenAI natif ne s’applique jamais : aucun service_tier, aucun store de Responses, aucune indication de cache de prompt et aucune mise en forme de charge utile pour la compatibilité du raisonnement OpenAI ne sont envoyés.

Dépannage

inferrs n’est pas en cours d’exécution, n’est pas accessible ou n’est pas lié à l’hôte ou au port que vous avez configuré. Vérifiez que le serveur est démarré et écoute à cette adresse.
Définissez compat.requiresStringContent: true dans l’entrée du modèle (voir ci-dessus).
Définissez compat.supportsTools: false pour désactiver l’exposition du schéma des outils (voir la mise en garde concernant Gemma ci-dessus).
Si les erreurs de schéma ont disparu, mais qu’inferrs plante toujours lors de tours d’agent plus volumineux, considérez qu’il s’agit d’une limitation d’inferrs ou du modèle en amont. Réduisez la pression exercée par le prompt ou changez de backend ou de modèle.
Pour obtenir une aide générale, consultez Dépannage et FAQ.

Ressources connexes

Modèles locaux

Exécution d’OpenClaw avec des serveurs de modèles locaux.

Services de modèles locaux

Démarrage à la demande de serveurs de modèles locaux pour les fournisseurs configurés.

Dépannage du Gateway

Dépannage des backends locaux compatibles avec OpenAI qui réussissent les tests directs, mais échouent lors des exécutions d’agent.

Sélection du modèle

Présentation de tous les fournisseurs, des références de modèles et du comportement de basculement.