Open SourceInferenz21k
MLC LLM
Universelle LLM-Deployment-Engine, die Modelle für jedes Gerät kompiliert.
MLC LLM ist eine Open-Source-Machine-Learning-Kompilierungs-Engine für das native Deployment von LLMs auf einer Vielzahl von Hardware, darunter iOS, Android, Browser (WebGPU) sowie CPUs und GPUs. Aufgebaut auf Apache TVM kompiliert und optimiert es Modelle pro Zielplattform und liefert die MLCEngine mit einer OpenAI-kompatiblen API für lokales und serverseitiges Serving. Es ist ein führendes Projekt zum Betrieb von LLMs auf Edge- und Consumer-Geräten.
Repository
mlc-ai/mlc-llmSprache
PythonWas du damit bauen kannst
- LLMs nativ auf iOS, Android oder im Browser via WebGPU deployen
- Modelle mit einer einzigen universellen Engine für diverse Hardware-Ziele kompilieren
- Eine OpenAI-kompatible API auf Edge- oder Consumer-Geräten ohne Cloud-GPU bereitstellen
Tags
servingedgecompilationwebgpu