Qwen: Qwen3 235B A22B Thinking 2507

qwen/qwen3-235b-a22b-thinking-2507

Qwen3-235B-A22B-Thinking-2507 is a high-performance, open-weight Mixture-of-Experts (MoE) language model optimized for complex reasoning tasks. It activates 22B of its 235B parameters per forward pass and natively supports up to 262,144...

모달리티
텍스트
입력 / 출력 단가
₩404 / ₩4,037
1M
컨텍스트
13.11만
출시
2025. 7. 25.

FAQ

자주 묻는 질문

이 모델은 어떻게 호출하나요?

`/api/v1/chat/completions` 에 `model` 을 이 모델 ID 로 넣어 보내면 됩니다. OpenAI SDK 의 base_url 만 바꾸면 그대로 동작합니다.

단가는 어떻게 계산되나요?

원가(USD)에 환율과 마진을 곱해 원화 단가를 만듭니다. 요청 하나의 비용은 응답 헤더와 사용 내역에 그대로 남습니다.

로컬 GPU 로 처리되나요?

이 모델을 로컬 GPU 가 서비스하고 있으면 로컬을 먼저 씁니다. 로컬이 없거나 실패하면 외부 프로바이더로 넘어갑니다.

대화 내용이 저장되나요?

API 호출 본문은 저장하지 않습니다. Chat 화면의 대화만 저장하며, 설정에서 끌 수 있습니다.

자세히 보기