Google: Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite

Gemini 2.5 Flash-Lite is a lightweight reasoning model in the Gemini 2.5 family, optimized for ultra-low latency and cost efficiency. It offers improved throughput, faster token generation, and better performance...

الأنماط
نصصورةملفصوتفيديو
سعر المدخلات / المخرجات
‏١٧٦ ₩ / ‏٧٠٢ ₩
1M
السياق
١٫٠٥ مليون
تاريخ الإصدار
٢٣‏/٠٧‏/٢٠٢٥

الأسئلة الشائعة

الأسئلة الشائعة

كيف يمكنني استدعاء هذا النموذج؟

أرسل طلباً إلى `/api/v1/chat/completions` مع ضبط `model` على معرف هذا النموذج. تغيير الـ base_url لـ OpenAI SDK كافٍ.

كيف يتم حساب السعر؟

يتم ضرب التكلفة الأصلية بالـ USD في سعر الصرف والهامش لإنتاج السعر بالـ KRW. يتم تسجيل تكلفة كل طلب في ترويسات الاستجابة وفي سجل النشاط الخاص بك.

هل يعمل هذا على GPU محلي؟

إذا كان هناك GPU محلي يخدم هذا النموذج، فسيتم استخدامه أولاً. في حال عدم وجود مساحة محلية أو فشلها، يتم تحويل الطلب إلى مزود خارجي.

هل يتم تخزين محادثاتي؟

لا يتم تخزين أجسام طلبات الـ API أبداً. يتم حفظ المحادثات من شاشة Chat فقط، ويمكنك إيقاف ذلك من الإعدادات.

لمعرفة المزيد