Inception: Mercury 2.5 Preview
inception/mercury-2.5-preview
Mercury 2.5 is the fastest reasoning LLM, and the latest diffusion LLM (dLLM) from Inception. Instead of generating tokens sequentially, Mercury 2.5 produces and refines multiple tokens in parallel, achieving...
Modalities
Text
In / out price
₩70 / ₩263
1M
Context
2.6 लाख
रिलीज़
1 सित॰ 2026
FAQ
अक्सर पूछे जाने वाले प्रश्न
मैं इस मॉडल को कैसे कॉल करूँ?
OpenAI SDK के base_url को बदलना ही काफी है। `model` को इस मॉडल ID पर सेट करके `/api/v1/chat/completions` पर एक अनुरोध भेजें।
कीमत की गणना कैसे की जाती है?
USD में अपस्ट्रीम लागत को विनिमय दर और मार्जिन से गुणा करके KRW कीमत प्राप्त की जाती है। प्रत्येक अनुरोध की लागत रिस्पॉन्स हेडर और आपके एक्टिविटी लॉग में दर्ज की जाती है।
क्या यह लोकल GPU पर चलता है?
यदि कोई लोकल GPU इस मॉडल को सर्व करता है, तो वह पहले आता है। जब कोई लोकल स्लॉट उपलब्ध नहीं होता या वह विफल हो जाता है, तो अनुरोध बाहरी प्रोवाइडर के पास चला जाता है।
क्या मेरी बातचीत स्टोर की जाती है?
API अनुरोध बॉडी कभी स्टोर नहीं की जाती है। केवल चैट स्क्रीन की बातचीत सहेजी जाती है, और आप इसे सेटिंग्स में बंद कर सकते हैं।