Öppen källkodInferens21k
MLC LLM
Universell LLM-driftsättningsmotor som kompilerar modeller för vilken enhet som helst.
MLC LLM är en open source-kompileringsmotor för maskininlärning för att driftsätta LLMs native på ett brett spektrum av hårdvara, inklusive iOS, Android, webbläsare (WebGPU) och CPU:er/GPU:er. Byggt på Apache TVM kompilerar och optimerar det modeller per mål, och levereras med MLCEngine med ett OpenAI-kompatibelt API för både lokal och serverbaserad serving. Det är ett ledande projekt för att köra LLMs på kant- och konsumentenheter.
Kodförråd
mlc-ai/mlc-llmSpråk
PythonVad du kan bygga med det
- Driftsätta LLMs native på iOS, Android eller i webbläsaren via WebGPU
- Kompilera modeller för olika hårdvarumål med en enda universell motor
- Driftsätta ett OpenAI-kompatibelt API på kant- eller konsumentenheter utan moln-GPU
Taggar
servingedgecompilationwebgpu