Open SourceLocal100k
Ollama
Exécutez Llama, Mistral et leurs homologues en local avec une seule commande.
Ollama est un outil open source permettant d'exécuter des grands modèles de langage en local avec une seule commande. Il conditionne les poids du modèle, la configuration et un moteur d'exécution (basé sur llama.cpp) en un simple CLI et un serveur HTTP local, gérant le téléchargement des modèles, les formats de quantification et l'accélération GPU sous macOS, Linux et Windows. Il expose une API REST et un endpoint compatible OpenAI, facilitant l'appel de modèles locaux depuis les applications.
Dépôt
ollama/ollamaLangage
GoCe que vous pourriez construire avec
- Exécuter des modèles open weight comme Llama, Mistral ou Qwen en local pour une inférence privée et hors ligne durant le développement
- Servir un modèle local derrière une API compatible OpenAI afin que le code applicatif existant puisse basculer du cloud vers le local avec un minimum de modifications
- Prototyper des agents et des pipelines RAG contre des modèles locaux pour éviter les coûts d'API par token
Tags
local-llmclimodels