Open SourceLokaal100k
Ollama
Draai Llama, Mistral en andere modellen lokaal met één commando.
Ollama is een open-source tool voor het lokaal uitvoeren van grote taalmodellen met één commando. Het verpakt modelgewichten, configuratie en een runtime (gebouwd op llama.cpp) in een eenvoudige CLI en lokale HTTP-server, en regelt het downloaden van modellen, kwantisatieformaten en GPU-versnelling op macOS, Linux en Windows. Het biedt een REST API en een OpenAI-compatibel endpoint, waardoor lokale modellen eenvoudig vanuit applicaties aan te roepen zijn.
Opslagplaats
ollama/ollamaTaal
GoWat je ermee zou bouwen
- Open-weight modellen zoals Llama, Mistral of Qwen lokaal draaien voor privé, offline inferentie tijdens de ontwikkelfase
- Een lokaal model serveren achter een OpenAI-compatibele API zodat bestaande applicatiecode met minimale aanpassingen van cloud naar lokaal kan overstappen
- Agents en RAG-pipelines prototypen met lokale modellen om kosten per token te vermijden
Tags
local-llmclimodels