Qwen: Qwen3 235B A22B Thinking 2507
qwen/qwen3-235b-a22b-thinking-2507
Qwen3-235B-A22B-Thinking-2507 is a high-performance, open-weight Mixture-of-Experts (MoE) language model optimized for complex reasoning tasks. It activates 22B of its 235B parameters per forward pass and natively supports up to 262,144...
Modalities
Teks
Harga in / out
₩404 / ₩4.037
1M
Context
131,07 rb
Dirilis
25 Jul 2025
FAQ
Pertanyaan yang sering diajukan
Bagaimana cara memanggil model ini?
Kirim permintaan ke `/api/v1/chat/completions` dengan `model` diatur ke ID model ini. Mengubah base_url pada OpenAI SDK sudah cukup.
Bagaimana harga dihitung?
Biaya upstream dalam USD dikalikan dengan nilai tukar dan margin untuk menghasilkan harga KRW. Biaya setiap permintaan dicatat dalam header respons dan dalam log aktivitas Anda.
Apakah ini berjalan di GPU lokal?
Jika GPU lokal melayani model ini, permintaan akan diprioritaskan ke sana. Jika tidak ada slot lokal atau terjadi kegagalan, permintaan akan dialihkan ke penyedia eksternal.
Apakah percakapan saya disimpan?
Body permintaan API tidak pernah disimpan. Hanya percakapan dari layar Chat yang disimpan, dan Anda dapat menonaktifkannya di pengaturan.