Qwen: Qwen3 VL 8B Thinking

qwen/qwen3-vl-8b-thinking

Qwen3-VL-8B-Thinking is the reasoning-optimized variant of the Qwen3-VL-8B multimodal model, designed for advanced visual and textual reasoning across complex scenes, documents, and temporal sequences. It integrates enhanced multimodal alignment and...

Модальности
ИзображениеТекст
Цена за вход / выход
316 ₩ / 3 686 ₩
1M
Контекст
131,07 тыс.
Дата выпуска
15 окт. 2025 г.

FAQ

Часто задаваемые вопросы

Как вызвать эту модель?

Отправьте запрос на `/api/v1/chat/completions`, установив `model` на ID этой модели. Достаточно изменить base_url в OpenAI SDK.

Как рассчитывается цена?

Себестоимость в USD умножается на обменный курс и маржу для получения цены в KRW. Стоимость каждого запроса фиксируется в заголовках ответа и в журнале активности.

Работает ли это на локальной GPU?

Если модель обслуживается на локальной GPU, запрос идет сначала на неё. Если локального слота нет или произошла ошибка, запрос передается внешнему провайдеру.

Сохраняются ли мои диалоги?

Тела API-запросов никогда не сохраняются. Сохраняются только диалоги из экрана Chat, и это можно отключить в настройках.

Подробнее