Open SourceInferenza11k
OpenLLM
Esegui qualsiasi LLM open come endpoint API compatibile con OpenAI, ovunque.
OpenLLM, del team BentoML, consente di eseguire LLM open-source e fine-tuned come endpoint API compatibili con OpenAI con un singolo comando. Supporta modelli popolari out of the box, backend di inferenza ottimizzati come vLLM, una chat UI integrata e il deployment con un clic su Docker, Kubernetes o BentoCloud. È pensato per rendere semplice e portabile il self-hosting di API LLM in produzione.
Repository
bentoml/OpenLLMLinguaggio
PythonCosa ci costruiresti
- Avvio di un endpoint compatibile con OpenAI per qualsiasi modello open supportato con un solo comando
- Impacchettamento di un servizio LLM in un Bento per deployment riproducibile su Docker/Kubernetes
- Serving di modelli fine-tuned con inferenza basata su vLLM e una chat UI integrata
Tag
servingopenai-compatibledeploymentself-hosted