Qwen: Qwen3 235B A22B Thinking 2507
qwen/qwen3-235b-a22b-thinking-2507
Qwen3-235B-A22B-Thinking-2507 is a high-performance, open-weight Mixture-of-Experts (MoE) language model optimized for complex reasoning tasks. It activates 22B of its 235B parameters per forward pass and natively supports up to 262,144...
Modalidades
Texto
Precio entrada / salida
404 KRW / 4037 KRW
1M
Contexto
131,07 mil
Lanzado
25 jul 2025
FAQ
Preguntas frecuentes
¿Cómo llamo a este modelo?
Envía una solicitud a `/api/v1/chat/completions` con `model` configurado con este ID de modelo. Cambiar el base_url del SDK de OpenAI es suficiente.
¿Cómo se calcula el precio?
El coste upstream en USD se multiplica por el tipo de cambio y el margen para producir un precio en KRW. El coste de cada solicitud se registra en los headers de la respuesta y en tu registro de actividad.
¿Se ejecuta en una GPU local?
Si una GPU local sirve este modelo, se utiliza primero. Cuando no hay un slot local o este falla, la solicitud pasa a un proveedor externo.
¿Se guardan mis conversaciones?
Los cuerpos de las solicitudes de la API nunca se guardan. Solo se guardan las conversaciones de la pantalla de Chat, y puedes desactivar eso en la configuración.