Google: Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...

Modalities
TextImageFileAudioVideo
In / out price
₩176 / ₩702
1M
Context
10.49 लाख
रिलीज़
23 जुल॰ 2025

FAQ

अक्सर पूछे जाने वाले प्रश्न

मैं इस मॉडल को कैसे कॉल करूँ?

OpenAI SDK के base_url को बदलना ही काफी है। `model` को इस मॉडल ID पर सेट करके `/api/v1/chat/completions` पर एक अनुरोध भेजें।

कीमत की गणना कैसे की जाती है?

USD में अपस्ट्रीम लागत को विनिमय दर और मार्जिन से गुणा करके KRW कीमत प्राप्त की जाती है। प्रत्येक अनुरोध की लागत रिस्पॉन्स हेडर और आपके एक्टिविटी लॉग में दर्ज की जाती है।

क्या यह लोकल GPU पर चलता है?

यदि कोई लोकल GPU इस मॉडल को सर्व करता है, तो वह पहले आता है। जब कोई लोकल स्लॉट उपलब्ध नहीं होता या वह विफल हो जाता है, तो अनुरोध बाहरी प्रोवाइडर के पास चला जाता है।

क्या मेरी बातचीत स्टोर की जाती है?

API अनुरोध बॉडी कभी स्टोर नहीं की जाती है। केवल चैट स्क्रीन की बातचीत सहेजी जाती है, और आप इसे सेटिंग्स में बंद कर सकते हैं।

अधिक जानें