Z.ai: GLM 5.3 Flash

z-ai/glm-5.3-flash

GLM-5.3-Flash is a native multimodal model from Z.ai. It is suited for efficient coding and long-horizon agent tasks. Its hybrid sparse and linear attention architecture maintains accurate long-context behavior while...

Modalities
TeksGambarVideo
Harga in / out
₩132 / ₩439
1M
Context
1,31 jt
Dirilis
26 Agu 2026

FAQ

Pertanyaan yang sering diajukan

Bagaimana cara memanggil model ini?

Kirim permintaan ke `/api/v1/chat/completions` dengan `model` diatur ke ID model ini. Mengubah base_url pada OpenAI SDK sudah cukup.

Bagaimana harga dihitung?

Biaya upstream dalam USD dikalikan dengan nilai tukar dan margin untuk menghasilkan harga KRW. Biaya setiap permintaan dicatat dalam header respons dan dalam log aktivitas Anda.

Apakah ini berjalan di GPU lokal?

Jika GPU lokal melayani model ini, permintaan akan diprioritaskan ke sana. Jika tidak ada slot lokal atau terjadi kegagalan, permintaan akan dialihkan ke penyedia eksternal.

Apakah percakapan saya disimpan?

Body permintaan API tidak pernah disimpan. Hanya percakapan dari layar Chat yang disimpan, dan Anda dapat menonaktifkannya di pengaturan.

Pelajari selengkapnya