Llama 3.3 on Ollama
Min VRAM: 48 GB
Pull
ollama pull llama3.3
Run
ollama run llama3.3
API
After running, Ollama serves an OpenAI-compatible API at http://localhost:11434/v1.
Min VRAM: 48 GB
ollama pull llama3.3
ollama run llama3.3
After running, Ollama serves an OpenAI-compatible API at http://localhost:11434/v1.