Åpen kildekodeInferens11k
OpenLLM
Kjør enhver åpen LLM som et OpenAI-kompatibelt API-endepunkt, uansett hvor.
OpenLLM, fra BentoML-teamet, lar deg kjøre åpen kildekode- og finjusterte LLM-er som OpenAI-kompatible API-endepunkter med én enkelt kommando. Det støtter populære modeller fra bunnen av, optimaliserte inferensbakends som vLLM, et innebygd chat-UI og ett-klikks-distribusjon til Docker, Kubernetes eller BentoCloud. Det er utformet for å gjøre selvhosting av produksjons-LLM-APIer enkelt og portabelt.
Kodelager
bentoml/OpenLLMSpråk
PythonDet du kan bygge med den
- Starte et OpenAI-kompatibelt endepunkt for enhver støttet åpen modell med én kommando
- Pakke en LLM-tjeneste inn i en Bento for reproduserbar Docker/Kubernetes-distribusjon
- Serving av finjusterte modeller med vLLM-støttet inferens og et innebygd chat-UI
Tagger
servingopenai-compatibledeploymentself-hosted