Inception: Mercury 2.5 Preview

inception/mercury-2.5-preview

Mercury 2.5 is the fastest reasoning LLM, and the latest diffusion LLM (dLLM) from Inception. Instead of generating tokens sequentially, Mercury 2.5 produces and refines multiple tokens in parallel, achieving...

Modalities
Teks
Harga in / out
₩70 / ₩263
1M
Context
260 rb
Dirilis
1 Sep 2026

FAQ

Pertanyaan yang sering diajukan

Bagaimana cara memanggil model ini?

Kirim permintaan ke `/api/v1/chat/completions` dengan `model` diatur ke ID model ini. Mengubah base_url pada OpenAI SDK sudah cukup.

Bagaimana harga dihitung?

Biaya upstream dalam USD dikalikan dengan nilai tukar dan margin untuk menghasilkan harga KRW. Biaya setiap permintaan dicatat dalam header respons dan dalam log aktivitas Anda.

Apakah ini berjalan di GPU lokal?

Jika GPU lokal melayani model ini, permintaan akan diprioritaskan ke sana. Jika tidak ada slot lokal atau terjadi kegagalan, permintaan akan dialihkan ke penyedia eksternal.

Apakah percakapan saya disimpan?

Body permintaan API tidak pernah disimpan. Hanya percakapan dari layar Chat yang disimpan, dan Anda dapat menonaktifkannya di pengaturan.

Pelajari selengkapnya