All Models

Llama 3.2 11B Vision Instruct

llama Tool Calling Attachments Open Weights Structured Output

Open Llama multimodal model for image understanding and text reasoning

Providers 5
Released Sep 18, 2024
Input Modalities text, image
Output Modalities text
Tarsk Use coding

Available Providers (5)

Provider Model ID Input Cost Output Cost Context Max Output Docs
Nvidia meta/llama-3.2-11b-vision-instruct $0/MTok $0/MTok 128K 4.1K
Cloudflare Workers AI @cf/meta/llama-3.2-11b-vision-instruct $0.05/MTok $0.68/MTok 128K 128K
Cloudflare AI Gateway workers-ai/@cf/meta/llama-3.2-11b-vision-instruct $0.05/MTok $0.68/MTok 128K 128K
Inference meta/llama-3.2-11b-vision-instruct $0.06/MTok $0.06/MTok 16K 4.1K
Eden AI deepinfra/meta-llama/Llama-3.2-11B-Vision-Instruct $0.34/MTok $0.34/MTok 131.1K 4.1K

Capabilities

Reasoning
Tool Calling
Attachments
Open Weights
Structured Output