Llama 3.2 on Ollama
Min VRAM: 4 GB
Pull
ollama pull llama3.2
Run
ollama run llama3.2
API
After running, Ollama serves an OpenAI-compatible API at http://localhost:11434/v1.
Min VRAM: 4 GB
ollama pull llama3.2
ollama run llama3.2
After running, Ollama serves an OpenAI-compatible API at http://localhost:11434/v1.