Inception: Mercury 2.5 Preview

inception/mercury-2.5-preview

Mercury 2.5 is the fastest reasoning LLM, and the latest diffusion LLM (dLLM) from Inception. Instead of generating tokens sequentially, Mercury 2.5 produces and refines multiple tokens in parallel, achieving...

Modalities
Text
In / out price
₩70 / ₩263
1M
Context
26万
リリース日
2026/09/01

FAQ

よくある質問

このモデルを呼び出すにはどうすればよいですか?

`model` にこのモデルIDを設定して `/api/v1/chat/completions` にリクエストを送信してください。OpenAI SDKのbase_urlを変更するだけで十分です。

価格はどのように計算されますか?

USDでのアップストリームコストに、為替レートとマージンを乗じてKRW価格を算出します。各リクエストのコストは、レスポンスヘッダーとアクティビティログに記録されます。

これはローカルのGPUで動作しますか?

ローカルのGPUがこのモデルを提供している場合は、まずそちらが優先されます。ローカルのスロットがない場合や失敗した場合は、リクエストは外部プロバイダーに転送されます。

会話は保存されますか?

APIのリクエストボディが保存されることはありません。Chat画面からの会話のみが保存されますが、これは設定でオフにできます。

詳細を見る