Open SourceInferenza21k
MLC LLM
Motore universale di deployment LLM che compila i modelli per qualsiasi dispositivo.
MLC LLM è un motore open-source di compilazione machine learning per il deployment nativo di LLM su un'ampia gamma di hardware, inclusi iOS, Android, browser (WebGPU) e CPU/GPU. Basato su Apache TVM, compila e ottimizza i modelli per ogni target e include MLCEngine con un'API compatibile con OpenAI per il serving sia locale che server-side. È uno dei progetti di riferimento per eseguire LLM su dispositivi edge e consumer.
Repository
mlc-ai/mlc-llmLinguaggio
PythonCosa ci costruiresti
- Deployment nativo di LLM su iOS, Android o nel browser tramite WebGPU
- Compilazione di modelli per target hardware diversi con un unico motore universale
- Serving di un'API compatibile con OpenAI su dispositivi edge o consumer senza una GPU cloud
Tag
servingedgecompilationwebgpu