Llama 3.3 on Ollama

Min VRAM: 48 GB

Pull

ollama pull llama3.3

Run

ollama run llama3.3

API

After running, Ollama serves an OpenAI-compatible API at http://localhost:11434/v1.

Model card