Inception: Mercury 2.5 Preview

inception/mercury-2.5-preview

Mercury 2.5 is the fastest reasoning LLM, and the latest diffusion LLM (dLLM) from Inception. Instead of generating tokens sequentially, Mercury 2.5 produces and refines multiple tokens in parallel, achieving...

Modalidades
Texto
Preço in / out
₩ 70 / ₩ 263
1M
Contexto
260 mil
Lançado
1 de set. de 2026

FAQ

Perguntas frequentes

Como eu chamo este modelo?

Envie uma requisição para `/api/v1/chat/completions` com o `model` definido para este ID de modelo. Alterar a base_url do SDK da OpenAI é o suficiente.

Como o preço é calculado?

O custo upstream em USD é multiplicado pela taxa de câmbio e pela margem para gerar o preço em KRW. O custo de cada requisição é registrado nos headers da resposta e no seu log de atividade.

Isso roda em uma GPU local?

Se uma GPU local atender este modelo, ela tem prioridade. Quando não há slot local ou ele falha, a requisição é direcionada para um provedor externo.

Minhas conversas são armazenadas?

Corpos de requisições de API nunca são armazenados. Apenas conversas da tela de Chat são salvas, e você pode desativar isso nas configurações.

Saiba mais