Google: Gemma 4 26B A4B
google/gemma-4-26b-a4b-it
Gemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind. Despite 25.2B total parameters, only 3.8B activate per token during inference — delivering near-31B quality at...
Modalities
ImageTextVideo
In / out price
₩123 / ₩597
1M
Context
2.62 लाख
रिलीज़
3 अप्रैल 2026
FAQ
अक्सर पूछे जाने वाले प्रश्न
मैं इस मॉडल को कैसे कॉल करूँ?
OpenAI SDK के base_url को बदलना ही काफी है। `model` को इस मॉडल ID पर सेट करके `/api/v1/chat/completions` पर एक अनुरोध भेजें।
कीमत की गणना कैसे की जाती है?
USD में अपस्ट्रीम लागत को विनिमय दर और मार्जिन से गुणा करके KRW कीमत प्राप्त की जाती है। प्रत्येक अनुरोध की लागत रिस्पॉन्स हेडर और आपके एक्टिविटी लॉग में दर्ज की जाती है।
क्या यह लोकल GPU पर चलता है?
यदि कोई लोकल GPU इस मॉडल को सर्व करता है, तो वह पहले आता है। जब कोई लोकल स्लॉट उपलब्ध नहीं होता या वह विफल हो जाता है, तो अनुरोध बाहरी प्रोवाइडर के पास चला जाता है।
क्या मेरी बातचीत स्टोर की जाती है?
API अनुरोध बॉडी कभी स्टोर नहीं की जाती है। केवल चैट स्क्रीन की बातचीत सहेजी जाती है, और आप इसे सेटिंग्स में बंद कर सकते हैं।