Qwen: Qwen3.8 2.4T A95B

qwen/qwen3.8-2.4t-a95b

Qwen3.8 2.4T A95B is an open-weight sparse mixture-of-experts model from Qwen and the open-weight variant of [Qwen3.8 Max](/qwen/qwen3.8-max), with 95 billion active parameters out of 2.4 trillion total. It is...

Modalités
Texte
Prix entrée / sortie
3 510 ₩ / 10 530 ₩
1M
Contexte
1,05 M
Publié
13 août 2026

FAQ

Foire aux questions

Comment appeler ce modèle ?

Envoyez une requête à `/api/v1/chat/completions` avec `model` défini sur cet ID de modèle. Modifier la base_url du SDK OpenAI est suffisant.

Comment le prix est-il calculé ?

Le coût amont en USD est multiplié par le taux de change et la marge pour obtenir un prix en KRW. Le coût de chaque requête est enregistré dans les en-têtes de réponse et dans votre journal d'activité.

Cela s'exécute-t-il sur un GPU local ?

Si un GPU local dessert ce modèle, il est prioritaire. En l'absence de slot local ou en cas d'échec, la requête est redirigée vers un fournisseur externe.

Mes conversations sont-elles stockées ?

Les corps de requête API ne sont jamais stockés. Seules les conversations de l'écran Chat sont sauvegardées, et vous pouvez désactiver cette option dans les paramètres.

En savoir plus