GLM API: ключ Z.ai, модели GLM-5.3 и Flash, подключение с оплатой в рубляхAPI для ИИ-агентов и кодинга: подключение из России

GLM API: ключ Z.ai, модели GLM-5.3 и Flash, подключение с оплатой в рублях

GLM API от Z.ai (Zhipu) совместим с OpenAI: ключ, base_url и имя модели — и GLM-5.3 работает в любом коде на OpenAI SDK, в Cline, Kilo Code и OpenCode. Официальный ключ выдаёт платформа Z.ai, баланс там пополняется зарубежной картой. Ниже — как получить ключ, какие модели и цены у GLM API, есть ли бесплатный вариант, как подключить GLM с оплатой в рублях и сколько это стоит на реальной нагрузке.

Короткий ответ

  • Официально: аккаунт на z.ai → Billing (пополнить) → API Keys → создать ключ. Адрес — https://api.z.ai/api/paas/v4/, модели — glm-5.3 и glm-5.3-flash.
  • С оплатой в рублях: OpenAI-совместимый API Twelver, серии zai (GLM-5.3) и zai-flash (GLM-5.3-Flash). Ключ — на этой странице, без регистрации и карты; ставки — как в прайсе Z.ai, по 100 ₽ за доллар.
1 млнтокенов контекста у GLM-5.3
$1,4 / $4,4вход / выход за 1 млн у GLM-5.3
15 / 50₽ за 1 млн, серия zai-flash в Twelver

Модели и цены GLM API

МодельДля чегоВходВход из кэшаВыход
glm-5.3Флагман: код, агенты, длинные задачи$1,40$0,26$4,40
glm-5.2Прошлый флагман, та же база$1,40$0,26$4,40
glm-5.3-flashxБыстрый Flash, ~200 токенов/с$0,37$0,075$1,25
glm-5.3-flashДешёвый мультимодальный уровень$0,15$0,03$0,50
glm-4.7-flash, glm-4.5-flashСтарые лёгкие моделибесплатнобесплатнобесплатно
Официальные цены Z.ai за 1 млн токенов, по docs.z.ai на 7 октября 2026 года.

GLM-5.3 работает только с текстом, держит контекст в 1 млн токенов и отвечает до 128 тыс. токенов за раз. Рассуждения у неё включены всегда: отключить их нельзя, можно только выбрать глубину параметром reasoning_effort — low, high или max (по умолчанию max). Старый код с "thinking": {"type": "disabled"} на GLM-5.3 падает с ошибкой — его нужно поменять на enabled и low. GLM-5.3-Flash, наоборот, принимает картинки, видео и файлы и стоит в девять раз дешевле по входу.

Как получить ключ GLM API официально

  1. Зарегистрируйтесь на платформе Z.ai (z.ai, раздел Model API).
  2. На странице Billing пополните баланс — бесплатные модели работают и без него, платные нет.
  3. Откройте API Keys, создайте ключ и скопируйте его в надёжное место.
  4. В OpenAI SDK укажите base_url="https://api.z.ai/api/paas/v4/" и модель glm-5.3.

Какой base_url брать: paas, coding или anthropic

  • https://api.z.ai/api/paas/v4/ — обычный API с оплатой токенов.
  • https://api.z.ai/api/coding/paas/v4 — адрес для подписки GLM Coding Plan (от $18 в месяц), которую подключают в агентах для кода.
  • https://api.z.ai/api/anthropic — формат Anthropic Messages для инструментов, которые говорят только на нём.

Почему не получается оплатить GLM API из России

Баланс Z.ai и подписка Coding Plan оплачиваются зарубежной картой. Карты российских банков для таких платежей не работают. Схемы с чужими картами здесь не разбираем — ниже легальный вариант с оплатой в рублях.

GLM API с оплатой в рублях

В Twelver GLM подключён к тому же OpenAI-совместимому API, что и остальные 13 серий моделей для кода. Ключ создаётся кнопкой ниже без регистрации и карты, баланс пополняется в рублях, а в коде меняются только base_url, ключ и имя модели.

Серия в TwelverМодельВход / выход, ₽ за 1 млнКак у Z.ai
zaiGLM-5.3140 / 440$1,4 / $4,4 × 100 ₽
zai-flashGLM-5.3-Flash15 / 50$0,15 / $0,5 × 100 ₽
Ставки на 06.09.2026. Актуальные — на /l/ru/twelver-coding-api.

Наценки к прайсу Z.ai нет, и скидка за кэш та же: входные токены из кэша стоят 26 ₽ за миллион у zai и 3 ₽ у zai-flash. Подписки здесь нет — платите только за потраченные токены, без помесячного минимума.

Прямо на странице

Base URL и ключ для GLM

В блоке появятся ваши значения — их можно сразу подставить в код ниже. Первый запрос можно отправить здесь же.

Нажмите — и получите base_url и API-ключ.

Регистрация и карта не нужны.

Бесплатно. Ключ появится прямо здесь.

Пример на Python

Шаблон — так работать не будетglm.pyПодсвеченное — заглушки. Их выдаёт кнопка выше: пара секунд, без регистрации и карты.
from openai import OpenAI

client = OpenAI(
    base_url="https://twelver.ru/api/ai/<ваш-config-id>/v1",
    api_key="sk-<ваш-ключ>",
)

reply = client.chat.completions.create(
    model="zai",          # GLM-5.3; для дешёвых запросов — "zai-flash"
    messages=[{"role": "user", "content": "Напиши тесты для функции: ..."}],
)
print(reply.choices[0].message.content)

Код под официальный API Z.ai переносится заменой трёх значений: base_url, api_key и model="glm-5.3" → model="zai". Остальное — сообщения, потоковый режим, вызов инструментов — остаётся как в OpenAI SDK.

Посчитайте стоимость запросов

Выберите тип нагрузки или впишите свои числа — калькулятор умножит их на ставки серий. Токен — примерно 3–4 символа русского текста или 4 символа английского и кода.

zaiGLM-5.314 184 ₽ в месяц
запрос: 4,73 ₽1000 запросов: 4 728 ₽
zai-flashGLM-5.3-Flash1 530 ₽ в месяц
запрос: 0,51 ₽1000 запросов: 510 ₽
autoQwen3.7-Plus4 176 ₽ в месяц
запрос: 1,39 ₽1000 запросов: 1 392 ₽
grokGrok 4.720 160 ₽ в месяц
запрос: 6,72 ₽1000 запросов: 6 720 ₽

Ставки Twelver на 06.09.2026; токены считаются по факту ответа, кэш и скидки не учтены. Арифметика выполняется в браузере.

На шаге агента разница между zai и zai-flash — почти десятикратная. Flash хорошо справляется с чатом, классификацией и вызовом инструментов, но на правке большого кода его не измеряли, поэтому для агента основной ставят GLM-5.3, а Flash — на служебные шаги.

GLM в Cline, Kilo Code и OpenCode

В агентах GLM подключается как OpenAI-совместимый провайдер: Base URL, ключ и модель zai. Пошагово: Cline, Kilo Code, OpenCode. Если раньше вы работали в Cursor — Cursor в России.

Не хочется разбираться

Попросите ИИ подключить GLM

Откроется чат с готовым вопросом: API-интегратор выдаст base_url и ключ, соберёт код или конфиг под ваш инструмент и посчитает стоимость запросов.

Что почитать дальше

Чем GLM-5.3 и Flash отличаются как модели и чем были 5.2 — GLM 5.3 в Twelver. То же для других моделей: Grok API, DeepSeek API, Qwen API; все провайдеры с бесплатными уровнями — API нейросетей. Вся книга — API для ИИ-агентов.

Частые вопросы

Как получить API-ключ GLM?
Официально — на платформе Z.ai: регистрация, пополнение на странице Billing, затем API Keys → создать ключ. Base URL для OpenAI SDK — https://api.z.ai/api/paas/v4/, модели — glm-5.3 и glm-5.3-flash. С оплатой в рублях ключ можно создать на этой странице: серии zai и zai-flash в OpenAI-совместимом API Twelver.
Есть ли бесплатный GLM API?
У Z.ai бесплатны старые лёгкие модели glm-4.7-flash и glm-4.5-flash. GLM-5.3 и GLM-5.3-Flash платные: $1,4 / $4,4 и $0,15 / $0,5 за 1 млн входных / выходных токенов. В Twelver первый запрос к GLM-5.3 можно отправить прямо на этой странице на стартовых токенах.
Сколько стоит GLM 5.3 API?
У Z.ai GLM-5.3 стоит $1,4 за 1 млн входных токенов, $0,26 за токены из кэша и $4,4 за 1 млн выходных. GLM-5.3-Flash — $0,15, $0,03 и $0,5. В Twelver серии zai и zai-flash идут по тем же ставкам в пересчёте 100 ₽ за доллар.
Чем GLM-5.3-Flash отличается от GLM-5.3?
Flash — отдельная модель, а не урезанная 5.3: она мультимодальная (понимает картинки, видео и файлы) и примерно в девять раз дешевле по входу. GLM-5.3 работает только с текстом, но сильнее на сложном коде и длинных агентных задачах.
Почему GLM-5.3 возвращает ошибку про thinking?
У GLM-5.3 рассуждения нельзя отключить. Запрос с "thinking": {"type": "disabled"} падает; нужно передать "enabled" и выбрать глубину через reasoning_effort: low, high или max.
Что такое GLM Coding Plan?
Это подписка Z.ai для агентов программирования — от $18 в месяц, с отдельным адресом https://api.z.ai/api/coding/paas/v4 и квотой в баллах вместо оплаты токенов. Для оплаты нужна зарубежная карта. Альтернатива без подписки — оплата токенов в рублях через Twelver.

Twelver API — GLM, Grok, DeepSeek, Qwen и GPT по одному OpenAI-совместимому ключу с оплатой в рублях.

Попробуйте сами

Получите base_url и ключ прямо сейчас

Кнопка на странице API выдаёт адрес и ключ сразу — без регистрации и без привязки карты.

Получить API-ключ
Оцените свой опыт