Qwen: Qwen3 235B A22B Thinking 2507

qwen/qwen3-235b-a22b-thinking-2507

Qwen3-235B-A22B-Thinking-2507 is a high-performance, open-weight Mixture-of-Experts (MoE) language model optimized for complex reasoning tasks. It activates 22B of its 235B parameters per forward pass and natively supports up to 262,144...

Модальности
Текст
Цена за вход / выход
404 ₩ / 4 037 ₩
1M
Контекст
131,07 тыс.
Дата выпуска
25 июл. 2025 г.

FAQ

Часто задаваемые вопросы

Как вызвать эту модель?

Отправьте запрос на `/api/v1/chat/completions`, установив `model` на ID этой модели. Достаточно изменить base_url в OpenAI SDK.

Как рассчитывается цена?

Себестоимость в USD умножается на обменный курс и маржу для получения цены в KRW. Стоимость каждого запроса фиксируется в заголовках ответа и в журнале активности.

Работает ли это на локальной GPU?

Если модель обслуживается на локальной GPU, запрос идет сначала на неё. Если локального слота нет или произошла ошибка, запрос передается внешнему провайдеру.

Сохраняются ли мои диалоги?

Тела API-запросов никогда не сохраняются. Сохраняются только диалоги из экрана Chat, и это можно отключить в настройках.

Подробнее