The Qwen3.5 native vision-language Flash models are built on a hybrid architecture that integrates a linear attention mechanism with a sparse mixture-of-experts model, achieving higher inference efficiency. Compared to the...

Modalities
TextImageVideo
In / out price
₩114 / ₩456
1M
Context
10 लाख
रिलीज़
26 फ़र॰ 2026

FAQ

अक्सर पूछे जाने वाले प्रश्न

मैं इस मॉडल को कैसे कॉल करूँ?

OpenAI SDK के base_url को बदलना ही काफी है। `model` को इस मॉडल ID पर सेट करके `/api/v1/chat/completions` पर एक अनुरोध भेजें।

कीमत की गणना कैसे की जाती है?

USD में अपस्ट्रीम लागत को विनिमय दर और मार्जिन से गुणा करके KRW कीमत प्राप्त की जाती है। प्रत्येक अनुरोध की लागत रिस्पॉन्स हेडर और आपके एक्टिविटी लॉग में दर्ज की जाती है।

क्या यह लोकल GPU पर चलता है?

यदि कोई लोकल GPU इस मॉडल को सर्व करता है, तो वह पहले आता है। जब कोई लोकल स्लॉट उपलब्ध नहीं होता या वह विफल हो जाता है, तो अनुरोध बाहरी प्रोवाइडर के पास चला जाता है।

क्या मेरी बातचीत स्टोर की जाती है?

API अनुरोध बॉडी कभी स्टोर नहीं की जाती है। केवल चैट स्क्रीन की बातचीत सहेजी जाती है, और आप इसे सेटिंग्स में बंद कर सकते हैं।

अधिक जानें