Qwen: Qwen3 235B A22B Thinking 2507
qwen/qwen3-235b-a22b-thinking-2507
Qwen3-235B-A22B-Thinking-2507 is a high-performance, open-weight Mixture-of-Experts (MoE) language model optimized for complex reasoning tasks. It activates 22B of its 235B parameters per forward pass and natively supports up to 262,144...
Modalidades
Texto
Preço in / out
₩ 404 / ₩ 4.037
1M
Contexto
131,07 mil
Lançado
25 de jul. de 2025
FAQ
Perguntas frequentes
Como eu chamo este modelo?
Envie uma requisição para `/api/v1/chat/completions` com o `model` definido para este ID de modelo. Alterar a base_url do SDK da OpenAI é o suficiente.
Como o preço é calculado?
O custo upstream em USD é multiplicado pela taxa de câmbio e pela margem para gerar o preço em KRW. O custo de cada requisição é registrado nos headers da resposta e no seu log de atividade.
Isso roda em uma GPU local?
Se uma GPU local atender este modelo, ela tem prioridade. Quando não há slot local ou ele falha, a requisição é direcionada para um provedor externo.
Minhas conversas são armazenadas?
Corpos de requisições de API nunca são armazenados. Apenas conversas da tela de Chat são salvas, e você pode desativar isso nas configurações.