Tout l'open source
Open SourceInférence21k

MLC LLM

Moteur de déploiement LLM universel qui compile les modèles pour n'importe quel appareil.

MLC LLM est un moteur de compilation machine learning open source pour déployer des LLM nativement sur une large gamme de matériels, notamment iOS, Android, navigateurs (WebGPU) et CPU/GPU. Construit sur Apache TVM, il compile et optimise les modèles par cible, et embarque MLCEngine avec une API compatible OpenAI pour le serving local et côté serveur. C'est un projet de référence pour exécuter des LLM sur des appareils edge et grand public.

Dépôt

mlc-ai/mlc-llm

Langage

Python

Ce que vous pourriez construire avec

  • Déployer des LLM nativement sur iOS, Android ou dans le navigateur via WebGPU
  • Compiler des modèles pour des cibles matérielles variées avec un seul moteur universel
  • Servir une API compatible OpenAI sur des appareils edge ou grand public sans GPU cloud

Tags

servingedgecompilationwebgpu