Alle open source
Open SourceInferentie11k

OpenLLM

Draai elk open LLM als een OpenAI-compatibel API-endpoint, waar dan ook.

OpenLLM, van het BentoML-team, stelt je in staat om open-source en fine-tuned LLM's als OpenAI-compatibele API-endpoints te draaien met één commando. Het ondersteunt populaire modellen out of the box, geoptimaliseerde inferentie-backends zoals vLLM, een ingebouwde chat-UI en één-klik-deployment naar Docker, Kubernetes of BentoCloud. Het is ontworpen om self-hosting van productie-LLM-API's eenvoudig en draagbaar te maken.

Opslagplaats

bentoml/OpenLLM

Taal

Python

Wat je ermee zou bouwen

  • Opstarten van een OpenAI-compatibel endpoint voor elk ondersteund open model met één commando
  • Verpakken van een LLM-service in een Bento voor reproduceerbare Docker/Kubernetes-deployment
  • Serveren van fine-tuned modellen met vLLM-ondersteunde inferentie en een ingebouwde chat-UI

Tags

servingopenai-compatibledeploymentself-hosted