All Models

Llama 3.2 11B Vision Instruct

Tool CallingAttachmentsOpen WeightsStructured Output

Open Llama multimodal model for image understanding and text reasoning

Providers4
ReleasedSep 18, 2024
Input Modalitiestext, image
Output Modalitiestext
Tarsk Usecoding

Available Providers (4)

ProviderModel IDInput CostOutput CostContextMax OutputDocs
Nvidiameta/llama-3.2-11b-vision-instruct$0/MTok$0/MTok128K4.1K
Cloudflare Workers AI@cf/meta/llama-3.2-11b-vision-instruct$0.05/MTok$0.68/MTok128K128K
Inferencemeta/llama-3.2-11b-vision-instruct$0.06/MTok$0.06/MTok16K4.1K
Eden AIdeepinfra/meta-llama/Llama-3.2-11B-Vision-Instruct$0.34/MTok$0.34/MTok131.1K4.1K

Capabilities

Reasoning
Tool Calling
Attachments
Open Weights
Structured Output