Tout l'open source
Open SourceLocal100k

Ollama

Exécutez Llama, Mistral et leurs homologues en local avec une seule commande.

Ollama est un outil open source permettant d'exécuter des grands modèles de langage en local avec une seule commande. Il conditionne les poids du modèle, la configuration et un moteur d'exécution (basé sur llama.cpp) en un simple CLI et un serveur HTTP local, gérant le téléchargement des modèles, les formats de quantification et l'accélération GPU sous macOS, Linux et Windows. Il expose une API REST et un endpoint compatible OpenAI, facilitant l'appel de modèles locaux depuis les applications.

Dépôt

ollama/ollama

Langage

Go

Ce que vous pourriez construire avec

  • Exécuter des modèles open weight comme Llama, Mistral ou Qwen en local pour une inférence privée et hors ligne durant le développement
  • Servir un modèle local derrière une API compatible OpenAI afin que le code applicatif existant puisse basculer du cloud vers le local avec un minimum de modifications
  • Prototyper des agents et des pipelines RAG contre des modèles locaux pour éviter les coûts d'API par token

Tags

local-llmclimodels