Z.ai: GLM 4.7 Flash

z-ai/glm-4.7-flash

As a 30B-class SOTA model, GLM-4.7-Flash offers a new option that balances performance and efficiency. It is further optimized for agentic coding use cases, strengthening coding capabilities, long-horizon task planning,...

Modalities
Text
Giá In / out
105 ₩ / 702 ₩
1M
Context
202,75 N
Ngày phát hành
19 thg 1, 2026

FAQ

Câu hỏi thường gặp

Làm thế nào để gọi model này?

Gửi một request đến `/api/v1/chat/completions` với `model` được thiết lập là ID model này. Chỉ cần thay đổi base_url của OpenAI SDK là đủ.

Giá được tính như thế nào?

Chi phí upstream bằng USD được nhân với tỷ giá hối đoái và biên lợi nhuận để tạo ra giá KRW. Chi phí của mỗi request được ghi lại trong response headers và trong nhật ký hoạt động của bạn.

Model này có chạy trên GPU cục bộ không?

Nếu một GPU cục bộ phục vụ model này, nó sẽ được ưu tiên trước. Khi không có slot cục bộ hoặc bị lỗi, request sẽ được chuyển đến nhà cung cấp bên ngoài.

Các cuộc hội thoại của tôi có được lưu trữ không?

Body của API request không bao giờ được lưu trữ. Chỉ các cuộc hội thoại từ màn hình Chat mới được lưu, và bạn có thể tắt tính năng đó trong phần cài đặt.

Tìm hiểu thêm