Z.ai: GLM 5.3 Flash
z-ai/glm-5.3-flash
GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...
Модальности
ТекстИзображениеВидео
Цена за вход / выход
132 ₩ / 439 ₩
1M
Контекст
1,31 млн
Дата выпуска
26 авг. 2026 г.
FAQ
Часто задаваемые вопросы
Как вызвать эту модель?
Отправьте запрос на `/api/v1/chat/completions`, установив `model` на ID этой модели. Достаточно изменить base_url в OpenAI SDK.
Как рассчитывается цена?
Себестоимость в USD умножается на обменный курс и маржу для получения цены в KRW. Стоимость каждого запроса фиксируется в заголовках ответа и в журнале активности.
Работает ли это на локальной GPU?
Если модель обслуживается на локальной GPU, запрос идет сначала на неё. Если локального слота нет или произошла ошибка, запрос передается внешнему провайдеру.
Сохраняются ли мои диалоги?
Тела API-запросов никогда не сохраняются. Сохраняются только диалоги из экрана Chat, и это можно отключить в настройках.