Skip to main content
inferrs предоставляет локальные модели через совместимый с OpenAI API /v1. OpenClaw взаимодействует с ним через универсальный адаптер openai-completions.
inferrs — это пользовательский самостоятельно размещаемый бэкенд, совместимый с OpenAI, а не отдельный плагин провайдера OpenClaw: его настраивают в models.providers.inferrs, а не выбирают вариант аутентификации при первоначальной настройке. Сведения о встроенном плагине с автоматическим обнаружением см. в разделах SGLang или vLLM.

Начало работы

1

Запустите inferrs с моделью

2

Убедитесь, что сервер доступен

3

Добавьте запись провайдера OpenClaw

Добавьте явную запись провайдера и укажите ее для модели по умолчанию. См. пример конфигурации ниже.

Полный пример конфигурации

Gemma 4 на локальном сервере inferrs:

Запуск по требованию

OpenClaw может самостоятельно запускать inferrs только при выборе модели inferrs/.... Добавьте localService в ту же запись провайдера:
command должен быть абсолютным путем. Выполните which inferrs на хосте Gateway и используйте полученный путь. Полное описание полей: Сервисы локальных моделей.

Расширенная конфигурация

Некоторые маршруты Chat Completions inferrs принимают в messages[].content только строки, а не структурированные массивы частей содержимого.
Если запуски OpenClaw завершаются со следующей ошибкой:
задайте compat.requiresStringContent: true в записи модели. После этого OpenClaw преобразует части содержимого, состоящие только из текста, в обычные строки перед отправкой запроса.
Некоторые сочетания inferrs и Gemma принимают небольшие прямые запросы /v1/chat/completions, но завершаются сбоем при полных циклах среды выполнения агента OpenClaw. Сначала попробуйте отключить поверхность схемы инструментов:
Это снижает нагрузку промпта на более строгие локальные бэкенды. Если небольшие прямые запросы по-прежнему работают, но обычные циклы агента OpenClaw продолжают завершаться сбоем внутри inferrs, считайте это ограничением вышестоящей модели или сервера, а не проблемой транспорта OpenClaw.
После настройки проверьте оба уровня:
Если первая команда работает, а вторая завершается сбоем, см. раздел «Устранение неполадок» ниже.
Поскольку inferrs использует универсальный адаптер openai-completions (а не openai-responses), формирование запросов, предназначенное только для нативного OpenAI, никогда не применяется: не отправляются ни service_tier, ни store Responses, ни подсказки для кэша промптов, ни совместимая с рассуждениями OpenAI структура полезной нагрузки.

Устранение неполадок

inferrs не запущен, недоступен или не привязан к настроенным хосту и порту. Убедитесь, что сервер запущен и прослушивает этот адрес.
Задайте compat.requiresStringContent: true в записи модели (см. выше).
Задайте compat.supportsTools: false, чтобы отключить поверхность схемы инструментов (см. ограничение Gemma выше).
Если ошибки схемы устранены, но inferrs по-прежнему аварийно завершается при более крупных циклах агента, считайте это ограничением вышестоящего inferrs или модели. Снизьте нагрузку промпта либо смените бэкенд или модель.
Общие рекомендации см. в разделах Устранение неполадок и Часто задаваемые вопросы.

Связанные разделы

Локальные модели

Использование OpenClaw с серверами локальных моделей.

Сервисы локальных моделей

Запуск серверов локальных моделей по требованию для настроенных провайдеров.

Устранение неполадок Gateway

Отладка локальных совместимых с OpenAI бэкендов, которые успешно проходят проверки, но завершаются сбоем при запусках агента.

Выбор модели

Обзор всех провайдеров, ссылок на модели и поведения при переключении после сбоя.