Open SourceInferentie21k
MLC LLM
Universele LLM-deployment-engine die modellen compileert voor elk apparaat.
MLC LLM is een open-source machine-learning compilatie-engine voor het native deployen van LLM's op een breed scala aan hardware, waaronder iOS, Android, browsers (WebGPU) en CPU's/GPU's. Gebouwd op Apache TVM compileert en optimaliseert het modellen per doelplatform, en wordt geleverd met MLCEngine met een OpenAI-compatibele API voor zowel lokale als server-side serving. Het is een toonaangevend project voor het draaien van LLM's op edge- en consumer-apparaten.
Opslagplaats
mlc-ai/mlc-llmTaal
PythonWat je ermee zou bouwen
- Natively deployen van LLM's op iOS, Android of in de browser via WebGPU
- Compileren van modellen voor diverse hardwareplatformen met één universele engine
- Serveren van een OpenAI-compatibele API op edge- of consumer-apparaten zonder cloud-GPU
Tags
servingedgecompilationwebgpu