Qwen: Qwen3 235B A22B Thinking 2507

qwen/qwen3-235b-a22b-thinking-2507

Qwen3-235B-A22B-Thinking-2507 is a high-performance, open-weight Mixture-of-Experts (MoE) language model optimized for complex reasoning tasks. It activates 22B of its 235B parameters per forward pass and natively supports up to 262,144...

Modalitäten
Text
In / out Preis
404 ₩ / 4.037 ₩
1M
Kontext
131.072
Veröffentlicht
25.07.2025

FAQ

Häufig gestellte Fragen

Wie rufe ich dieses Modell auf?

Sende eine Anfrage an `/api/v1/chat/completions`, wobei `model` auf diese Modell-ID gesetzt ist. Das Ändern der base_url des OpenAI SDKs ist ausreichend.

Wie wird der Preis berechnet?

Die Upstream-Kosten in USD werden mit dem Wechselkurs und der Marge multipliziert, um einen Preis in KRW zu ermitteln. Die Kosten jeder Anfrage werden in den Response-Headern und in Ihrem Aktivitätsprotokoll aufgezeichnet.

Läuft dies auf einer lokalen GPU?

Wenn eine lokale GPU dieses Modell bereitstellt, wird diese zuerst verwendet. Wenn kein lokaler Slot verfügbar ist oder ein Fehler auftritt, wird die Anfrage an einen externen Anbieter weitergeleitet.

Werden meine Konversationen gespeichert?

API-Request-Bodies werden niemals gespeichert. Nur Konversationen aus dem Chat-Bildschirm werden gespeichert, und dies kann in den Einstellungen deaktiviert werden.

Mehr erfahren