Skip to main content
Z.AI — це платформа API для моделей GLM. Вона надає REST API для GLM і використовує ключі API для автентифікації. Створіть ключ API в консолі Z.AI. OpenClaw використовує провайдера zai із ключем API Z.AI.

Моделі GLM

GLM — це сімейство моделей, а не окремий провайдер. В OpenClaw моделі GLM використовують посилання на кшталт zai/glm-5.2: провайдер zai, ідентифікатор моделі glm-5.2.

Початок роботи

Спочатку встановіть плагін провайдера:
Найкраще для: більшості користувачів. OpenClaw перевіряє підтримувані кінцеві точки Z.AI за допомогою вашого ключа API й автоматично застосовує правильну базову URL-адресу.
1

Запустіть початкове налаштування

2

Переконайтеся, що модель є у списку

Кінцеві точки

zai-api-key автоматично визначає одну з цих чотирьох кінцевих точок, перевіряючи ваш ключ через API чат-завершень кожної кінцевої точки: спочатку перевіряються загальні кінцеві точки (zai-global, потім zai-cn), а після них — кінцеві точки Coding Plan (zai-coding-global, потім zai-coding-cn); перевірка припиняється на першій кінцевій точці, яка прийме запит. Використовуйте явний варіант --auth-choice, щоб примусово вибрати кінцеву точку Coding Plan, якщо ваш ключ працює з обома типами.

Обмеження частоти запитів і перевантаження

Z.AI описує Coding Plan та агентські інструменти загального призначення як сервіси з керованою пропускною здатністю. Згідно з документацією Z.AI:
  • Агентські інструменти загального призначення, зокрема OpenClaw, обслуговуються за принципом максимально можливих зусиль. Під час високого навантаження на інференс, зазвичай приблизно з 2 до 6 години вечора за сінгапурським часом, для деяких запитів можуть тимчасово застосовуватися обмеження частоти.
  • Обмеження частоти й паралельності Coding Plan залежать від рівня плану та можуть динамічно коригуватися залежно від доступності ресурсів. У години поза піковим навантаженням рівень паралельності може бути вищим.
  • Код помилки API 1302 означає «Досягнуто обмеження частоти запитів». Код помилки API 1305 означає «Сервіс може бути тимчасово перевантажений, повторіть спробу пізніше».
Якщо в період високого навантаження ви отримали тимчасову відповідь 429 або 1305, зачекайте й повторіть запит. Якщо збої регулярно повторюються поза піковими періодами або виникають лише для однієї кінцевої точки, моделі чи форми запиту, спочатку перевірте налаштовані кінцеву точку та модель:
Ключі Coding Plan мають використовувати кінцеву точку Coding Plan, наприклад https://api.z.ai/api/coding/paas/v4; ключі загального API мають використовувати кінцеву точку загального API, наприклад https://api.z.ai/api/paas/v4. Постійні збої з тим самим ключем і кінцевою точкою можуть свідчити про відхилення запиту на боці провайдера або обмеження плану, а не про звичайне обмеження через пікове навантаження.

Приклад конфігурації

zai-api-key дає змогу OpenClaw визначити відповідну кінцеву точку Z.AI за ключем і автоматично застосувати правильну базову URL-адресу. Використовуйте явні регіональні варіанти, коли потрібно примусово вибрати певний Coding Plan або загальне API.

Вбудований каталог

Плагін провайдера zai постачається з каталогом у маніфесті плагіна, тому список лише для читання може відображати відомі записи GLM без завантаження середовища виконання провайдера:
Каталог на основі маніфесту наразі містить:
Моделі GLM доступні як zai/<model> (приклад: zai/glm-5).
Налаштування Coding Plan за замовчуванням використовує zai/glm-5.2; налаштування загального API зберігає zai/glm-5.1. На кінцевих точках Coding Plan автоматичне визначення використовує як резерв glm-5.1, а потім glm-4.7, коли ключ або план не надає доступу до GLM-5.2. Версії GLM і їх доступність можуть змінюватися; виконайте openclaw models list --all --provider zai, щоб переглянути каталог, відомий установленій версії.

Рівні міркування

Повний діапазон: off, low, high, max (за замовчуванням off). OpenClaw зіставляє low та high із рівнем зусиль для міркування high у Z.AI, а max — із рівнем зусиль max у Z.AI через reasoning_effort у корисному навантаженні запиту.
Якщо для міркування встановити off, відповіді не витрачатимуть бюджет виведення на reasoning_content перед видимим текстом.

Розширена конфігурація

Невідомі ідентифікатори glm-5* усе одно перспективно розпізнаються на шляху провайдера шляхом синтезу метаданих, що належать провайдеру, із шаблону glm-4.7, коли ідентифікатор відповідає поточній формі сімейства GLM-5.
tool_stream за замовчуванням увімкнено для потокового передавання викликів інструментів Z.AI. Щоб вимкнути його:
Збережене міркування потрібно вмикати явно, оскільки Z.AI вимагає повторного відтворення повного історичного reasoning_content, що збільшує кількість токенів запиту. Увімкніть його окремо для кожної моделі:
Коли цю функцію ввімкнено й міркування активне, OpenClaw надсилає thinking: { type: "enabled", clear_thinking: false } і повторно відтворює попередній reasoning_content для тієї самої сумісної з OpenAI транскрипції. Ключ параметра у форматі snake_case preserve_thinking працює як псевдонім.Досвідчені користувачі все одно можуть перевизначити точне корисне навантаження провайдера за допомогою params.extra_body.thinking.
Плагін Z.AI реєструє розуміння зображень.Розуміння зображень автоматично визначається на основі налаштованої автентифікації Z.AI — додаткова конфігурація не потрібна.
  • Z.AI використовує автентифікацію Bearer із вашим ключем API.
  • Варіант початкового налаштування zai-api-key автоматично визначає відповідну кінцеву точку Z.AI, перевіряючи підтримувані кінцеві точки за допомогою вашого ключа.
  • Використовуйте явні регіональні варіанти (zai-coding-global, zai-coding-cn, zai-global, zai-cn), коли потрібно примусово вибрати певне API.
  • Застаріла змінна середовища Z_AI_API_KEY усе ще підтримується; OpenClaw копіює її до ZAI_API_KEY під час запуску, якщо ZAI_API_KEY не задано.

Пов’язані матеріали

Вибір моделі

Вибір провайдерів, посилань на моделі та поведінки перемикання після збою.

Довідник із конфігурації

Повна схема конфігурації OpenClaw, зокрема налаштування провайдерів і моделей.