Tutto l'open source
Open SourceInferenza21k

MLC LLM

Motore universale di deployment LLM che compila i modelli per qualsiasi dispositivo.

MLC LLM è un motore open-source di compilazione machine learning per il deployment nativo di LLM su un'ampia gamma di hardware, inclusi iOS, Android, browser (WebGPU) e CPU/GPU. Basato su Apache TVM, compila e ottimizza i modelli per ogni target e include MLCEngine con un'API compatibile con OpenAI per il serving sia locale che server-side. È uno dei progetti di riferimento per eseguire LLM su dispositivi edge e consumer.

Repository

mlc-ai/mlc-llm

Linguaggio

Python

Cosa ci costruiresti

  • Deployment nativo di LLM su iOS, Android o nel browser tramite WebGPU
  • Compilazione di modelli per target hardware diversi con un unico motore universale
  • Serving di un'API compatibile con OpenAI su dispositivi edge o consumer senza una GPU cloud

Tag

servingedgecompilationwebgpu