/v1. OpenClaw взаємодіє з ним через універсальний адаптер openai-completions.
inferrs — це власний самостійно розміщений бекенд, сумісний з OpenAI, а не спеціалізований Plugin провайдера OpenClaw: ви налаштовуєте його в models.providers.inferrs, а не вибираєте варіант автентифікації під час початкового налаштування. Відомості про вбудований Plugin з автоматичним виявленням див. у розділах SGLang або vLLM.Початок роботи
1
Запустіть inferrs із моделлю
2
Перевірте доступність сервера
3
Додайте запис провайдера OpenClaw
Додайте явний запис провайдера та спрямуйте на нього модель за замовчуванням. Див. приклад конфігурації нижче.
Повний приклад конфігурації
Gemma 4 на локальному серверіinferrs:
Запуск на вимогу
OpenClaw може самостійно запускатиinferrs, лише коли вибрано модель inferrs/.... Додайте localService до того самого запису провайдера:
command має містити абсолютний шлях. Виконайте which inferrs на хості Gateway і використайте отриманий шлях. Повний опис полів: Служби локальних моделей.
Розширена конфігурація
Чому requiresStringContent має значення
Чому requiresStringContent має значення
Деякі маршрути Chat Completions у
inferrs приймають у messages[].content лише рядки, а не структуровані масиви частин вмісту.Застереження щодо Gemma та схеми інструментів
Застереження щодо Gemma та схеми інструментів
Деякі комбінації Це зменшує навантаження запиту на суворіші локальні бекенди. Якщо малі прямі запити й далі працюють, але звичайні цикли агента OpenClaw продовжують спричиняти аварійне завершення всередині
inferrs і Gemma приймають невеликі прямі запити /v1/chat/completions, але не можуть виконати повні цикли середовища виконання агента OpenClaw. Спочатку спробуйте вимкнути поверхню схеми інструментів:inferrs, вважайте це обмеженням моделі або сервера на стороні постачальника, а не проблемою транспорту OpenClaw.Ручна базова перевірка
Ручна базова перевірка
Після налаштування перевірте обидва рівні:Якщо перша команда працює, а друга завершується помилкою, див. розділ «Усунення несправностей» нижче.
Поведінка в режимі проксі
Поведінка в режимі проксі
Оскільки
inferrs використовує універсальний адаптер openai-completions (а не openai-responses), формування запитів, властиве лише нативному OpenAI, ніколи не застосовується: не надсилаються ані service_tier, ані store Responses, ані підказки кешу запитів, ані корисне навантаження сумісності міркувань OpenAI.Усунення несправностей
Помилка curl /v1/models
Помилка curl /v1/models
inferrs не запущено, він недоступний або не прив’язаний до налаштованих вами хоста чи порту. Переконайтеся, що сервер запущено й він прослуховує цю адресу.messages[].content очікує рядок
messages[].content очікує рядок
Установіть
compat.requiresStringContent: true у записі моделі (див. вище).Прямі виклики /v1/chat/completions успішні, але openclaw infer model run завершується помилкою
Прямі виклики /v1/chat/completions успішні, але openclaw infer model run завершується помилкою
Установіть
compat.supportsTools: false, щоб вимкнути поверхню схеми інструментів (див. застереження щодо Gemma вище).inferrs усе ще аварійно завершується під час більших циклів агента
inferrs усе ще аварійно завершується під час більших циклів агента
Якщо помилки схеми зникли, але
inferrs усе ще аварійно завершується під час більших циклів агента, вважайте це обмеженням inferrs або моделі на стороні постачальника. Зменште навантаження запиту або змініть бекенд чи модель.Пов’язані матеріали
Локальні моделі
Запуск OpenClaw із локальними серверами моделей.
Служби локальних моделей
Запуск локальних серверів моделей на вимогу для налаштованих провайдерів.
Усунення несправностей Gateway
Діагностика локальних сумісних з OpenAI бекендів, які проходять перевірки, але не можуть виконувати цикли агента.
Вибір моделі
Огляд усіх провайдерів, посилань на моделі та поведінки резервного перемикання.