Alle open source
Open SourceLokaal100k

Ollama

Draai Llama, Mistral en andere modellen lokaal met één commando.

Ollama is een open-source tool voor het lokaal uitvoeren van grote taalmodellen met één commando. Het verpakt modelgewichten, configuratie en een runtime (gebouwd op llama.cpp) in een eenvoudige CLI en lokale HTTP-server, en regelt het downloaden van modellen, kwantisatieformaten en GPU-versnelling op macOS, Linux en Windows. Het biedt een REST API en een OpenAI-compatibel endpoint, waardoor lokale modellen eenvoudig vanuit applicaties aan te roepen zijn.

Opslagplaats

ollama/ollama

Taal

Go

Wat je ermee zou bouwen

  • Open-weight modellen zoals Llama, Mistral of Qwen lokaal draaien voor privé, offline inferentie tijdens de ontwikkelfase
  • Een lokaal model serveren achter een OpenAI-compatibele API zodat bestaande applicatiecode met minimale aanpassingen van cloud naar lokaal kan overstappen
  • Agents en RAG-pipelines prototypen met lokale modellen om kosten per token te vermijden

Tags

local-llmclimodels