Mixtral 8x7B on Ollama

Min VRAM: 26 GB

Pull

ollama pull mixtral

Run

ollama run mixtral

API

After running, Ollama serves an OpenAI-compatible API at http://localhost:11434/v1.

Model card