Skip to main content
inferrs надає локальні моделі через сумісний з OpenAI API /v1. OpenClaw взаємодіє з ним через універсальний адаптер openai-completions.
inferrs — це власний самостійно розміщений бекенд, сумісний з OpenAI, а не спеціалізований Plugin провайдера OpenClaw: ви налаштовуєте його в models.providers.inferrs, а не вибираєте варіант автентифікації під час початкового налаштування. Відомості про вбудований Plugin з автоматичним виявленням див. у розділах SGLang або vLLM.

Початок роботи

1

Запустіть inferrs із моделлю

2

Перевірте доступність сервера

3

Додайте запис провайдера OpenClaw

Додайте явний запис провайдера та спрямуйте на нього модель за замовчуванням. Див. приклад конфігурації нижче.

Повний приклад конфігурації

Gemma 4 на локальному сервері inferrs:

Запуск на вимогу

OpenClaw може самостійно запускати inferrs, лише коли вибрано модель inferrs/.... Додайте localService до того самого запису провайдера:
command має містити абсолютний шлях. Виконайте which inferrs на хості Gateway і використайте отриманий шлях. Повний опис полів: Служби локальних моделей.

Розширена конфігурація

Деякі маршрути Chat Completions у inferrs приймають у messages[].content лише рядки, а не структуровані масиви частин вмісту.
Якщо виконання OpenClaw завершується помилкою:
установіть compat.requiresStringContent: true у записі моделі. Тоді OpenClaw перетворюватиме частини суто текстового вмісту на звичайні рядки перед надсиланням запиту.
Деякі комбінації inferrs і Gemma приймають невеликі прямі запити /v1/chat/completions, але не можуть виконати повні цикли середовища виконання агента OpenClaw. Спочатку спробуйте вимкнути поверхню схеми інструментів:
Це зменшує навантаження запиту на суворіші локальні бекенди. Якщо малі прямі запити й далі працюють, але звичайні цикли агента OpenClaw продовжують спричиняти аварійне завершення всередині inferrs, вважайте це обмеженням моделі або сервера на стороні постачальника, а не проблемою транспорту OpenClaw.
Після налаштування перевірте обидва рівні:
Якщо перша команда працює, а друга завершується помилкою, див. розділ «Усунення несправностей» нижче.
Оскільки inferrs використовує універсальний адаптер openai-completions (а не openai-responses), формування запитів, властиве лише нативному OpenAI, ніколи не застосовується: не надсилаються ані service_tier, ані store Responses, ані підказки кешу запитів, ані корисне навантаження сумісності міркувань OpenAI.

Усунення несправностей

inferrs не запущено, він недоступний або не прив’язаний до налаштованих вами хоста чи порту. Переконайтеся, що сервер запущено й він прослуховує цю адресу.
Установіть compat.requiresStringContent: true у записі моделі (див. вище).
Установіть compat.supportsTools: false, щоб вимкнути поверхню схеми інструментів (див. застереження щодо Gemma вище).
Якщо помилки схеми зникли, але inferrs усе ще аварійно завершується під час більших циклів агента, вважайте це обмеженням inferrs або моделі на стороні постачальника. Зменште навантаження запиту або змініть бекенд чи модель.
Загальну довідку див. у розділах Усунення несправностей і Поширені запитання.

Пов’язані матеріали

Локальні моделі

Запуск OpenClaw із локальними серверами моделей.

Служби локальних моделей

Запуск локальних серверів моделей на вимогу для налаштованих провайдерів.

Усунення несправностей Gateway

Діагностика локальних сумісних з OpenAI бекендів, які проходять перевірки, але не можуть виконувати цикли агента.

Вибір моделі

Огляд усіх провайдерів, посилань на моделі та поведінки резервного перемикання.