All Models

GLM 4.6V Original

glmAttachmentsOpen Weights

GLM-4.6V scales its context window to 128k tokens in training, and achieves SoTA performance in visual understanding among models of similar parameter scales. Integrates native Function Calling capabilities, bridging 'visual perception' and 'executable action' for multimodal agents. Direct via Z-AI (Zhipu).

Providers1
ReleasedDec 8, 2025
Input Modalitiestext, image
Output Modalitiestext

Available Providers (1)

ProviderModel IDInput CostOutput CostContextMax OutputDocs
NanoGPTz-ai/glm-4.6v-original$0.60/MTok$0.90/MTok128K24K

Capabilities

Reasoning
Tool Calling
Attachments
Open Weights
Structured Output