NVIDIA: Nemotron 3 Ultra
nvidia/nemotron-3-ultra-550b-a55b
NVIDIA Nemotron 3 Ultra is an open frontier-reasoning and orchestration model from NVIDIA, with 55B active parameters out of 550B total (MoE). Built on a hybrid Transformer-Mamba mixture-of-experts architecture, it...
Modalities
Text
In / out price
₩1,097 / ₩5,484
1M
Context
2.62 लाख
रिलीज़
4 जून 2026
FAQ
अक्सर पूछे जाने वाले प्रश्न
मैं इस मॉडल को कैसे कॉल करूँ?
OpenAI SDK के base_url को बदलना ही काफी है। `model` को इस मॉडल ID पर सेट करके `/api/v1/chat/completions` पर एक अनुरोध भेजें।
कीमत की गणना कैसे की जाती है?
USD में अपस्ट्रीम लागत को विनिमय दर और मार्जिन से गुणा करके KRW कीमत प्राप्त की जाती है। प्रत्येक अनुरोध की लागत रिस्पॉन्स हेडर और आपके एक्टिविटी लॉग में दर्ज की जाती है।
क्या यह लोकल GPU पर चलता है?
यदि कोई लोकल GPU इस मॉडल को सर्व करता है, तो वह पहले आता है। जब कोई लोकल स्लॉट उपलब्ध नहीं होता या वह विफल हो जाता है, तो अनुरोध बाहरी प्रोवाइडर के पास चला जाता है।
क्या मेरी बातचीत स्टोर की जाती है?
API अनुरोध बॉडी कभी स्टोर नहीं की जाती है। केवल चैट स्क्रीन की बातचीत सहेजी जाती है, और आप इसे सेटिंग्स में बंद कर सकते हैं।