Enhanced vision-language model from Zhipu AI with improved image understanding capabilities.
Specifications
Context
8K
Maximum Output
16.4K
Inputtext
Outputtext
Performance (7-day Average)
Collecting…
Collecting…
Collecting…
Pricing
Input¥4.40/MTokens
Output¥4.40/MTokens
Availability Trend (24h)
Performance Metrics (24h)
Similar Models
¥2.20/¥6.60/M
ctx64Kmax16Kavail—tps—
InOutCap
Zhipu AI's multimodal model with vision capabilities. Processes text, images, video, and files for analysis tasks.
¥4.40/¥13.20/M
ctx128Kmax—avail—tps—
InOutCap
Zhipu AI's GLM-4.5 AirX variant optimized for high-speed inference.
¥8.80/¥17.60/M
ctx128Kmax—avail—tps—
InOutCap
Zhipu AI's GLM-4.5 X variant with enhanced performance.
¥2.20/¥8.80/M
ctx131Kmax98Kavail—tps—
InOutCap
Zhipu AI's flagship Chinese-English bilingual model. Strong at complex reasoning and generation tasks.