Google: Gemma 4 26B A4B
google/gemma-4-26b-a4b-it
Gemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind. Despite 25.2B total parameters, only 3.8B activate per token during inference — delivering near-31B quality at...
Modalités
ImageTexteVidéo
Prix entrée / sortie
123 ₩ / 597 ₩
1M
Contexte
262,14 k
Publié
3 avr. 2026
FAQ
Foire aux questions
Comment appeler ce modèle ?
Envoyez une requête à `/api/v1/chat/completions` avec `model` défini sur cet ID de modèle. Modifier la base_url du SDK OpenAI est suffisant.
Comment le prix est-il calculé ?
Le coût amont en USD est multiplié par le taux de change et la marge pour obtenir un prix en KRW. Le coût de chaque requête est enregistré dans les en-têtes de réponse et dans votre journal d'activité.
Cela s'exécute-t-il sur un GPU local ?
Si un GPU local dessert ce modèle, il est prioritaire. En l'absence de slot local ou en cas d'échec, la requête est redirigée vers un fournisseur externe.
Mes conversations sont-elles stockées ?
Les corps de requête API ne sont jamais stockés. Seules les conversations de l'écran Chat sont sauvegardées, et vous pouvez désactiver cette option dans les paramètres.