Qwen: Qwen3.8 2.4T A95B

qwen/qwen3.8-2.4t-a95b

Qwen3.8 2.4T A95B is an open-weight sparse mixture-of-experts model from Qwen and the open-weight variant of [Qwen3.8 Max](/qwen/qwen3.8-max), with 95 billion active parameters out of 2.4 trillion total. It is...

Modalities
Text
輸入 / 輸出價格
₩3,510 / ₩10,530
1M
Context
104.86萬
發佈日期
2026年8月13日

FAQ

常見問題

如何呼叫此模型?

向 `/api/v1/chat/completions` 發送請求,並將 `model` 設定為此模型 ID。只需更改 OpenAI SDK 的 base_url 即可。

價格如何計算?

將 USD 的上游成本乘以匯率與利潤,得出 KRW 價格。每次請求的成本會記錄在回應標頭 (response headers) 與您的活動日誌中。

這會在本地 GPU 上執行嗎?

如果本地 GPU 提供此模型,會優先使用。當沒有本地插槽或執行失敗時,請求會轉向外部供應商。

我的對話會被儲存嗎?

API 請求主體絕不會被儲存。只有來自 Chat 畫面的對話會被儲存,您可以在設定中關閉此功能。

了解更多