All öppen källkod
Öppen källkodLokalt100k

Ollama

Kör Llama, Mistral och fler modeller lokalt med ett enda kommando.

Ollama är ett öppet verktyg för att köra stora språkmodeller lokalt med ett enda kommando. Det paketerar modellvikter, konfiguration och en körning (byggd på llama.cpp) i ett enkelt CLI och en lokal HTTP-server, och hanterar nedladdning av modeller, kvantiseringsformat och GPU-acceleration på macOS, Linux och Windows. Det exponerar ett REST API och en OpenAI-kompatibel endpoint, vilket gör lokala modeller enkla att anropa från applikationer.

Kodförråd

ollama/ollama

Språk

Go

Vad du kan bygga med det

  • Köra öppenviktsmodeller som Llama, Mistral eller Qwen lokalt för privat, offlineinferens under utveckling
  • Servera en lokal modell bakom ett OpenAI-kompatibelt API så att befintlig appkod kan växla från molnet till lokalt med minimala ändringar
  • Prototypa agenter och RAG-pipelines mot lokala modeller för att undvika API-kostnader per token

Taggar

local-llmclimodels