/v1. OpenClaw взаимодействует с ним через универсальный адаптер openai-completions.
inferrs — это пользовательский самостоятельно размещаемый бэкенд, совместимый с OpenAI, а не отдельный плагин провайдера OpenClaw: его настраивают в models.providers.inferrs, а не выбирают вариант аутентификации при первоначальной настройке. Сведения о встроенном плагине с автоматическим обнаружением см. в разделах SGLang или vLLM.Начало работы
1
Запустите inferrs с моделью
2
Убедитесь, что сервер доступен
3
Добавьте запись провайдера OpenClaw
Добавьте явную запись провайдера и укажите ее для модели по умолчанию. См. пример конфигурации ниже.
Полный пример конфигурации
Gemma 4 на локальном сервереinferrs:
Запуск по требованию
OpenClaw может самостоятельно запускатьinferrs только при выборе модели inferrs/.... Добавьте localService в ту же запись провайдера:
command должен быть абсолютным путем. Выполните which inferrs на хосте Gateway и используйте полученный путь. Полное описание полей: Сервисы локальных моделей.
Расширенная конфигурация
Почему requiresStringContent имеет значение
Почему requiresStringContent имеет значение
Некоторые маршруты Chat Completions
inferrs принимают в messages[].content только строки, а не структурированные массивы частей содержимого.Ограничение Gemma и схемы инструментов
Ограничение Gemma и схемы инструментов
Некоторые сочетания Это снижает нагрузку промпта на более строгие локальные бэкенды. Если небольшие прямые запросы по-прежнему работают, но обычные циклы агента OpenClaw продолжают завершаться сбоем внутри
inferrs и Gemma принимают небольшие прямые запросы /v1/chat/completions, но завершаются сбоем при полных циклах среды выполнения агента OpenClaw. Сначала попробуйте отключить поверхность схемы инструментов:inferrs, считайте это ограничением вышестоящей модели или сервера, а не проблемой транспорта OpenClaw.Ручная быстрая проверка
Ручная быстрая проверка
После настройки проверьте оба уровня:Если первая команда работает, а вторая завершается сбоем, см. раздел «Устранение неполадок» ниже.
Поведение в режиме прокси
Поведение в режиме прокси
Поскольку
inferrs использует универсальный адаптер openai-completions (а не openai-responses), формирование запросов, предназначенное только для нативного OpenAI, никогда не применяется: не отправляются ни service_tier, ни store Responses, ни подсказки для кэша промптов, ни совместимая с рассуждениями OpenAI структура полезной нагрузки.Устранение неполадок
Сбой curl /v1/models
Сбой curl /v1/models
inferrs не запущен, недоступен или не привязан к настроенным хосту и порту. Убедитесь, что сервер запущен и прослушивает этот адрес.messages[].content должна быть строкой
messages[].content должна быть строкой
Задайте
compat.requiresStringContent: true в записи модели (см. выше).Прямые вызовы /v1/chat/completions выполняются успешно, но openclaw infer model run завершается сбоем
Прямые вызовы /v1/chat/completions выполняются успешно, но openclaw infer model run завершается сбоем
Задайте
compat.supportsTools: false, чтобы отключить поверхность схемы инструментов (см. ограничение Gemma выше).inferrs по-прежнему аварийно завершается при более крупных циклах агента
inferrs по-прежнему аварийно завершается при более крупных циклах агента
Если ошибки схемы устранены, но
inferrs по-прежнему аварийно завершается при более крупных циклах агента, считайте это ограничением вышестоящего inferrs или модели. Снизьте нагрузку промпта либо смените бэкенд или модель.Связанные разделы
Локальные модели
Использование OpenClaw с серверами локальных моделей.
Сервисы локальных моделей
Запуск серверов локальных моделей по требованию для настроенных провайдеров.
Устранение неполадок Gateway
Отладка локальных совместимых с OpenAI бэкендов, которые успешно проходят проверки, но завершаются сбоем при запусках агента.
Выбор модели
Обзор всех провайдеров, ссылок на модели и поведения при переключении после сбоя.