All Models
Vision Medium
Balanced multimodal model pairing a 1M-token context window with deeper reasoning for analysis, content creation, and tool use across text, image, audio, video, and PDF inputs.
Available Providers (1)
| Provider | Model ID | Input Cost | Output Cost | Context | Max Output | Docs |
|---|---|---|---|---|---|---|
vispark/vision-medium | $4.21/MTok | $12.63/MTok | 1M | 65.5K |
Capabilities
Reasoning
Tool Calling
Attachments
Open Weights
Structured Output