GLM-4.5V is a vision-language foundation model for multimodal agent applications. Built on a Mixture-of-Experts (MoE) architecture with 106B parameters and 12B activated parameters, it achieves state-of-the-art results in video understanding,...
Modalities
TextImage
輸入 / 輸出價格
₩1,053 / ₩3,159
1M
Context
6.55萬
發佈日期
2025年8月11日
此模型尚無基準測試數據。