Qwen: Qwen3 30B A3B Instruct 2507

qwen/qwen3-30b-a3b-instruct-2507

Qwen3-30B-A3B-Instruct-2507 is a 30.5B-parameter mixture-of-experts language model from Qwen, with 3.3B active parameters per inference. It operates in non-thinking mode and is designed for high-quality instruction following, multilingual understanding, and...

Modalidades
Texto
Precio entrada / salida
85 KRW / 339 KRW
1M
Contexto
262,14 mil
Lanzado
30 jul 2025

FAQ

Preguntas frecuentes

¿Cómo llamo a este modelo?

Envía una solicitud a `/api/v1/chat/completions` con `model` configurado con este ID de modelo. Cambiar el base_url del SDK de OpenAI es suficiente.

¿Cómo se calcula el precio?

El coste upstream en USD se multiplica por el tipo de cambio y el margen para producir un precio en KRW. El coste de cada solicitud se registra en los headers de la respuesta y en tu registro de actividad.

¿Se ejecuta en una GPU local?

Si una GPU local sirve este modelo, se utiliza primero. Cuando no hay un slot local o este falla, la solicitud pasa a un proveedor externo.

¿Se guardan mis conversaciones?

Los cuerpos de las solicitudes de la API nunca se guardan. Solo se guardan las conversaciones de la pantalla de Chat, y puedes desactivar eso en la configuración.

Más información