Z.ai: GLM 5.1

z-ai/glm-5.1-20260406

Модальности

Цена ввод / вывод

— / —за 1M токенов

Контекст203K

Релиз7 апр. 2026 г.

Провайдеры

Одна и та же модель может быть доступна у разных провайдеров. Маршрутизация выбирает эндпоинт по политике, цене, задержке и доступности.

Нет активных эндпоинтов для этой модели.

Производительность

Пропускная способность — скорость генерации (ток/с, выше лучше). Задержка — полный round-trip (ниже лучше). TTFT — время до первого токена (ниже лучше). Графики разбиты по провайдерам — нажмите expand для деталей.

Пропускная способность—лучший провайдер

Задержка—P50, лучший провайдер

Регион

Период

Пропускная способность

Выше — лучше

Загрузка…

Задержка

Ниже — лучше

Загрузка…

E2E задержка

Ниже — лучше

Загрузка…

TTFT

Ниже — лучше

Загрузка…

Ошибки tool call

Ниже — лучше

Загрузка…

Ошибки structured output

Ниже — лучше

Загрузка…

Тарифы

Базовая цена за миллион токенов. Эффективная цена учитывает prompt caching: повторяющийся контекст тарифицируется по ставке cache_read.

Ввод (list)—за 1M токенов

Вывод—за 1M токенов

Эффективная цена ввода

Фактическая стоимость prompt + cache_read на миллион токенов.

Ниже — лучше

Загрузка…

Cache read токены

Доля контекста, прочитанного из кэша провайдера.

Загрузка…

Бенчмарки

Результаты на стандартизированных оценках. Проценты и ранги показывают положение модели среди моделей каталога.

Агентные задачи29.9%

Программирование55.8%

Индекс интеллекта40.2%

Arena	Категория	Elo	Win rate	Ранг
models	Dataviz	1366	67.0%	#2
agents	Agenticslides	1245	54.4%	#3
agents	Python-Pptxslides	1258	54.2%	#3
agents	Agenticgamedev	1216	54.1%	#4
agents	Agenticslides(Python-Pptx)	1240	53.3%	#4
agents	Godotgamedev	1236	55.9%	#4
agents	Pptxslides	1241	53.5%	#4
models	3d	1343	64.0%	#5
models	Codecategories	1333	60.6%	#5
models	Svg	1285	62.3%	#5
models	Uicomponent	1342	63.1%	#5
models	Gamedev	1339	62.2%	#6
models	Website	1320	57.4%	#6
agents	Agentichtmlslides	1205	52.0%	#6
agents	Agenticslides(Html)	1204	51.8%	#6
agents	Fullstack	1235	57.2%	#7
agents	Htmlslides	1207	52.6%	#7
agents	Mobileapps	1236	55.5%	#7
agents	Androidnative	1233	52.8%	#10
agents	Webapps	1242	55.3%	#10
models	Asciiart	1149	45.5%	#38

Активность

Объём запросов и токенов к модели за последние 7 дней.

Запросы

Число обращений к модели.

Загрузка…

Токены

Prompt и completion суммарно.

—

Загрузка…

Доступность

Доля успешных ответов за период. Мониторинг эндпоинтов и автоматический fallback при ошибках upstream.

Успешные запросы

Процент ответов без ошибки.

Выше — лучше

Загрузка…

Быстрый старт

Готовый код для вызова модели. API совместим с OpenAI — достаточно указать base_url LLM Router. Меняется только slug модели: z-ai/glm-5.1-20260406.

curl -s "https://llmmart.ru/api/v1/v1/chat/completions" \
  -H "Authorization: Bearer $LLM_ROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-5.1-20260406",
    "messages": [
      {"role": "user", "content": "Привет!"}
    ]
  }'

Нужен API-ключ организации — создайте ключ в личном кабинете или см. инструкцию. Подробнее: первый запрос к модели и примеры SDK.

Z.ai: GLM 5.1

Провайдеры

Производительность

Пропускная способность

Задержка

E2E задержка

TTFT

Ошибки tool call

Ошибки structured output

Тарифы

Эффективная цена ввода

Cache read токены

Бенчмарки

Активность

Запросы

Токены

Доступность

Успешные запросы

Быстрый старт

Ещё модели от Z.ai

Z.ai: GLM 5.2

Z.ai: GLM 5V Turbo

Z.ai: GLM 5 Turbo

Z.ai: GLM 5

Z.ai: GLM 4.7 Flash

Z.ai: GLM 4.7

Z.ai: GLM 4.6V

Z.ai: GLM 4.6

Z.ai: GLM 4.5V

Z.ai: GLM 4.5

Z.ai: GLM 4.5 Air