zai із ключем API Z.AI.
Моделі GLM
GLM — це сімейство моделей, а не окремий провайдер. В OpenClaw моделі GLM використовують посилання на кшталтzai/glm-5.2: провайдер zai, ідентифікатор моделі glm-5.2.
Початок роботи
Спочатку встановіть плагін провайдера:- Автоматичне визначення кінцевої точки
- Явно вказана регіональна кінцева точка
Найкраще для: більшості користувачів. OpenClaw перевіряє підтримувані кінцеві точки Z.AI за допомогою вашого ключа API й автоматично застосовує правильну базову URL-адресу.
1
Запустіть початкове налаштування
2
Переконайтеся, що модель є у списку
Кінцеві точки
zai-api-key автоматично визначає одну з цих чотирьох кінцевих точок, перевіряючи ваш ключ через API
чат-завершень кожної кінцевої точки: спочатку перевіряються загальні кінцеві точки (zai-global,
потім zai-cn), а після них — кінцеві точки Coding Plan (zai-coding-global, потім
zai-coding-cn); перевірка припиняється на першій кінцевій точці, яка прийме запит.
Використовуйте явний варіант --auth-choice, щоб примусово вибрати кінцеву точку Coding Plan, якщо ваш ключ
працює з обома типами.
Обмеження частоти запитів і перевантаження
Z.AI описує Coding Plan та агентські інструменти загального призначення як сервіси з керованою пропускною здатністю. Згідно з документацією Z.AI:- Агентські інструменти загального призначення, зокрема OpenClaw, обслуговуються за принципом максимально можливих зусиль. Під час високого навантаження на інференс, зазвичай приблизно з 2 до 6 години вечора за сінгапурським часом, для деяких запитів можуть тимчасово застосовуватися обмеження частоти.
- Обмеження частоти й паралельності Coding Plan залежать від рівня плану та можуть динамічно коригуватися залежно від доступності ресурсів. У години поза піковим навантаженням рівень паралельності може бути вищим.
- Код помилки API
1302означає «Досягнуто обмеження частоти запитів». Код помилки API1305означає «Сервіс може бути тимчасово перевантажений, повторіть спробу пізніше».
429 або 1305, зачекайте й
повторіть запит. Якщо збої регулярно повторюються поза піковими періодами або
виникають лише для однієї кінцевої точки, моделі чи форми запиту, спочатку перевірте налаштовані кінцеву точку
та модель:
https://api.z.ai/api/coding/paas/v4; ключі загального API мають використовувати кінцеву точку
загального API, наприклад https://api.z.ai/api/paas/v4. Постійні збої з тим самим
ключем і кінцевою точкою можуть свідчити про відхилення запиту на боці провайдера або обмеження плану,
а не про звичайне обмеження через пікове навантаження.
Приклад конфігурації
Вбудований каталог
Плагін провайдераzai постачається з каталогом у маніфесті плагіна, тому список лише для читання
може відображати відомі записи GLM без завантаження середовища виконання провайдера:
Налаштування Coding Plan за замовчуванням використовує
zai/glm-5.2; налаштування загального API зберігає
zai/glm-5.1. На кінцевих точках Coding Plan автоматичне визначення використовує як резерв
glm-5.1, а потім glm-4.7, коли ключ або план не надає доступу до GLM-5.2. Версії GLM
і їх доступність можуть змінюватися; виконайте openclaw models list --all --provider zai,
щоб переглянути каталог, відомий установленій версії.Рівні міркування
- GLM-5.2
- Інші моделі GLM
Повний діапазон:
off, low, high, max (за замовчуванням off). OpenClaw зіставляє
low та high із рівнем зусиль для міркування high у Z.AI, а max — із
рівнем зусиль max у Z.AI через reasoning_effort у корисному навантаженні запиту.off, відповіді не витрачатимуть бюджет виведення на
reasoning_content перед видимим текстом.
Розширена конфігурація
Потокове передавання викликів інструментів
Потокове передавання викликів інструментів
tool_stream за замовчуванням увімкнено для потокового передавання викликів інструментів Z.AI. Щоб вимкнути його:Збережене міркування
Збережене міркування
Збережене міркування потрібно вмикати явно, оскільки Z.AI вимагає повторного відтворення повного історичного
Коли цю функцію ввімкнено й міркування активне, OpenClaw надсилає
reasoning_content, що збільшує кількість токенів запиту. Увімкніть його
окремо для кожної моделі:thinking: { type: "enabled", clear_thinking: false } і повторно відтворює попередній
reasoning_content для тієї самої сумісної з OpenAI транскрипції. Ключ параметра у форматі snake_case
preserve_thinking працює як псевдонім.Досвідчені користувачі все одно можуть перевизначити точне корисне навантаження провайдера за допомогою
params.extra_body.thinking.Розуміння зображень
Розуміння зображень
Плагін Z.AI реєструє розуміння зображень.
Розуміння зображень автоматично визначається на основі налаштованої автентифікації Z.AI —
додаткова конфігурація не потрібна.
Відомості про автентифікацію
Відомості про автентифікацію
- Z.AI використовує автентифікацію Bearer із вашим ключем API.
- Варіант початкового налаштування
zai-api-keyавтоматично визначає відповідну кінцеву точку Z.AI, перевіряючи підтримувані кінцеві точки за допомогою вашого ключа. - Використовуйте явні регіональні варіанти (
zai-coding-global,zai-coding-cn,zai-global,zai-cn), коли потрібно примусово вибрати певне API. - Застаріла змінна середовища
Z_AI_API_KEYусе ще підтримується; OpenClaw копіює її доZAI_API_KEYпід час запуску, якщоZAI_API_KEYне задано.
Пов’язані матеріали
Вибір моделі
Вибір провайдерів, посилань на моделі та поведінки перемикання після збою.
Довідник із конфігурації
Повна схема конфігурації OpenClaw, зокрема налаштування провайдерів і моделей.