Google: Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...

Modalities
TeksGambarFileAudioVideo
Harga in / out
₩176 / ₩702
1M
Context
1,05 jt
Dirilis
23 Jul 2025

FAQ

Pertanyaan yang sering diajukan

Bagaimana cara memanggil model ini?

Kirim permintaan ke `/api/v1/chat/completions` dengan `model` diatur ke ID model ini. Mengubah base_url pada OpenAI SDK sudah cukup.

Bagaimana harga dihitung?

Biaya upstream dalam USD dikalikan dengan nilai tukar dan margin untuk menghasilkan harga KRW. Biaya setiap permintaan dicatat dalam header respons dan dalam log aktivitas Anda.

Apakah ini berjalan di GPU lokal?

Jika GPU lokal melayani model ini, permintaan akan diprioritaskan ke sana. Jika tidak ada slot lokal atau terjadi kegagalan, permintaan akan dialihkan ke penyedia eksternal.

Apakah percakapan saya disimpan?

Body permintaan API tidak pernah disimpan. Hanya percakapan dari layar Chat yang disimpan, dan Anda dapat menonaktifkannya di pengaturan.

Pelajari selengkapnya