inclusionAI: Ling 3.0 Flash

inclusionai/ling-3.0-flash

*Ling-3.0-flash* is a *124B-parameter Mixture-of-Experts (MoE) model*, with approximately *5.1B parameters activated per token*. The model is designed with *token efficiency and production-scale agentic inference* as key priorities, enabling developers...

Modalities
Text
In / out price
₩37 / ₩111
1M
Context
26.21万
リリース日
2026/07/23

FAQ

よくある質問

このモデルを呼び出すにはどうすればよいですか?

`model` にこのモデルIDを設定して `/api/v1/chat/completions` にリクエストを送信してください。OpenAI SDKのbase_urlを変更するだけで十分です。

価格はどのように計算されますか?

USDでのアップストリームコストに、為替レートとマージンを乗じてKRW価格を算出します。各リクエストのコストは、レスポンスヘッダーとアクティビティログに記録されます。

これはローカルのGPUで動作しますか?

ローカルのGPUがこのモデルを提供している場合は、まずそちらが優先されます。ローカルのスロットがない場合や失敗した場合は、リクエストは外部プロバイダーに転送されます。

会話は保存されますか?

APIのリクエストボディが保存されることはありません。Chat画面からの会話のみが保存されますが、これは設定でオフにできます。

詳細を見る