As a 30B-class SOTA model, GLM-4.7-Flash offers a new option that balances performance and efficiency. It is further optimized for agentic coding use cases, strengthening coding capabilities, long-horizon task planning,...

Модальности
Текст
Цена за вход / выход
105 ₩ / 702 ₩
1M
Контекст
202,75 тыс.
Дата выпуска
19 янв. 2026 г.

FAQ

Часто задаваемые вопросы

Как вызвать эту модель?

Отправьте запрос на `/api/v1/chat/completions`, установив `model` на ID этой модели. Достаточно изменить base_url в OpenAI SDK.

Как рассчитывается цена?

Себестоимость в USD умножается на обменный курс и маржу для получения цены в KRW. Стоимость каждого запроса фиксируется в заголовках ответа и в журнале активности.

Работает ли это на локальной GPU?

Если модель обслуживается на локальной GPU, запрос идет сначала на неё. Если локального слота нет или произошла ошибка, запрос передается внешнему провайдеру.

Сохраняются ли мои диалоги?

Тела API-запросов никогда не сохраняются. Сохраняются только диалоги из экрана Chat, и это можно отключить в настройках.

Подробнее