Open SourceInférence11k
OpenLLM
Exécutez n'importe quel LLM open source comme endpoint d'API compatible OpenAI, partout.
OpenLLM, développé par l'équipe BentoML, permet d'exécuter des LLM open source et fine-tunés en tant qu'endpoints d'API compatibles OpenAI avec une seule commande. Il prend en charge les modèles populaires nativement, des backends d'inférence optimisés comme vLLM, une interface de chat intégrée, et un déploiement en un clic vers Docker, Kubernetes ou BentoCloud. Il est conçu pour rendre le self-hosting d'API LLM de production simple et portable.
Dépôt
bentoml/OpenLLMLangage
PythonCe que vous pourriez construire avec
- Démarrer un endpoint compatible OpenAI pour n'importe quel modèle open supporté avec une seule commande
- Packager un service LLM en Bento pour un déploiement reproductible Docker/Kubernetes
- Servir des modèles fine-tunés avec l'inférence propulsée par vLLM et une interface de chat intégrée
Tags
servingopenai-compatibledeploymentself-hosted