Meta: Llama 4 Maverick
meta-llama/llama-4-maverick
Llama 4 Maverick 17B Instruct (128E) is a high-capacity multimodal language model from Meta, built on a mixture-of-experts (MoE) architecture with 128 experts and 17 billion active parameters per forward...
Modalities
TextImage
Giá In / out
351 ₩ / 1.221 ₩
1M
Context
1,05 Tr
Ngày phát hành
6 thg 4, 2025
FAQ
Câu hỏi thường gặp
Làm thế nào để gọi model này?
Gửi một request đến `/api/v1/chat/completions` với `model` được thiết lập là ID model này. Chỉ cần thay đổi base_url của OpenAI SDK là đủ.
Giá được tính như thế nào?
Chi phí upstream bằng USD được nhân với tỷ giá hối đoái và biên lợi nhuận để tạo ra giá KRW. Chi phí của mỗi request được ghi lại trong response headers và trong nhật ký hoạt động của bạn.
Model này có chạy trên GPU cục bộ không?
Nếu một GPU cục bộ phục vụ model này, nó sẽ được ưu tiên trước. Khi không có slot cục bộ hoặc bị lỗi, request sẽ được chuyển đến nhà cung cấp bên ngoài.
Các cuộc hội thoại của tôi có được lưu trữ không?
Body của API request không bao giờ được lưu trữ. Chỉ các cuộc hội thoại từ màn hình Chat mới được lưu, và bạn có thể tắt tính năng đó trong phần cài đặt.