Google: Gemma 4 26B A4B
google/gemma-4-26b-a4b-it
Gemma 4 26B A4B IT is an instruction-tuned Mixture-of-Experts (MoE) model from Google DeepMind. Despite 25.2B total parameters, only 3.8B activate per token during inference — delivering near-31B quality at...
Modalities
GambarTeksVideo
Harga in / out
₩123 / ₩597
1M
Context
262,14 rb
Dirilis
3 Apr 2026
FAQ
Pertanyaan yang sering diajukan
Bagaimana cara memanggil model ini?
Kirim permintaan ke `/api/v1/chat/completions` dengan `model` diatur ke ID model ini. Mengubah base_url pada OpenAI SDK sudah cukup.
Bagaimana harga dihitung?
Biaya upstream dalam USD dikalikan dengan nilai tukar dan margin untuk menghasilkan harga KRW. Biaya setiap permintaan dicatat dalam header respons dan dalam log aktivitas Anda.
Apakah ini berjalan di GPU lokal?
Jika GPU lokal melayani model ini, permintaan akan diprioritaskan ke sana. Jika tidak ada slot lokal atau terjadi kegagalan, permintaan akan dialihkan ke penyedia eksternal.
Apakah percakapan saya disimpan?
Body permintaan API tidak pernah disimpan. Hanya percakapan dari layar Chat yang disimpan, dan Anda dapat menonaktifkannya di pengaturan.