Açık KaynakYerel100k
Ollama
Llama, Mistral ve benzerlerini tek bir komutla yerel olarak çalıştırın.
Ollama, büyük dil modellerini tek bir komutla yerel olarak çalıştırmaya yarayan açık kaynaklı bir araçtır. Model ağırlıklarını, yapılandırmasını ve bir çalışma zamanını (llama.cpp üzerine kurulu) basit bir CLI ve yerel HTTP sunucusunda paketler; macOS, Linux ve Windows üzerinde model indirme, kuantizasyon formatları ve GPU hızlandırmayı yönetir. Bir REST API ve OpenAI uyumlu bir endpoint sunar, bu sayede uygulamalardan yerel modelleri çağırmayı kolaylaştırır.
Depo
ollama/ollamaDil
GoBununla neler kurabilirsin
- Geliştirme sırasında gizli, çevrimdışı çıkarım için Llama, Mistral veya Qwen gibi açık ağırlıklı modelleri yerel olarak çalıştırma
- Mevcut uygulama kodunun minimum değişiklikle buluttan yerele geçebilmesi için yerel bir modeli OpenAI uyumlu API'nin arkasında sunma
- Token başına API maliyetlerinden kaçınmak için yerel modellere karşı ajan ve RAG pipeline'larını prototipleme
Etiketler
local-llmclimodels