Aller au contenu principal
buildradar
Sign in
Sujet · vllm

vllm

Dépôts open source suivis étiquetés vllm, triés par étoiles.

52 dépôts
  • prometheus-eval@prometheus-eval

    Évaluez les réponses de votre LLM avec Prometheus et GPT4.

    1 114+4Évolution des étoiles sur les 7 derniers jours
  • tiny-vllm@jmaczan

    Construisez votre propre moteur d'inférence LLM haute performance en C++ et CUDA - une version allégée de vLLM

    1 100+15Évolution des étoiles sur les 7 derniers jours
  • verl-omni@verl-project

    Framework d'entraînement RL multimodal pour modèles de diffusion et omni

    983+73Évolution des étoiles sur les 7 derniers jours
  • UniRL@Tencent-Hunyuan

    UniRL est un framework pour l'apprentissage par renforcement de modèles multimodaux unifiés.

    939+18Évolution des étoiles sur les 7 derniers jours
  • llm_note@harleyszhang

    Notes sur les LLM, incluant l'inférence de modèles, la structure des modèles transformer et l'analyse du code des frameworks LLM.

    890+2Évolution des étoiles sur les 7 derniers jours
  • Feuille de route de 10 semaines, à raison de 30 minutes par jour, sur l'inférence et l'optimisation de LLM : vLLM, SGLang, quantification, décodage spéculatif et benchmarking.

    887+78Évolution des étoiles sur les 7 derniers jours
  • local_ai_ocr@th1nhhdk

    Un logiciel OCR local, hors ligne (après configuration initiale) et portable, capable de traiter des images et des fichiers PDF en utilisant l'IA DeepSeek-OCR-2 (exécutée directement sur votre machine).

    874+4Évolution des étoiles sur les 7 derniers jours
  • llm-server-docs@varunvasudeva1

    Documentation complète pour configurer votre propre serveur LLM local et privé sur Debian, incluant chat, recherche web, RAG, gestion de modèles, serveurs MCP, génération d'images et synthèse vocale.

    833-2Évolution des étoiles sur les 7 derniers jours
  • llmcord@jakobdylanc

    Transformez Discord en interface pour LLM - Compatible avec toute API conforme à OpenAI (OpenRouter, Ollama, etc.)

    830+5Évolution des étoiles sur les 7 derniers jours
  • BambooAI@pgalko

    Bibliothèque Python basée sur des modèles de langage (LLM) pour la découverte et l'analyse conversationnelle de données.

    787+1Évolution des étoiles sur les 7 derniers jours
  • LightCompress@ModelTC

    [EMNLP 2024 & AAAI 2026] Une boîte à outils puissante pour la compression de grands modèles, incluant les LLM, les VLM et les modèles génératifs vidéo.

    747+4Évolution des étoiles sur les 7 derniers jours
  • pegainfer@pegainfer-project

    Moteur d'inférence LLM en Rust pur et CUDA — sans PyTorch, compatible avec OpenAI, servant Qwen3 vers Kimi-K2.

    678+17Évolution des étoiles sur les 7 derniers jours
  • vidur@microsoft

    Simulateur précis, à grande échelle et extensible pour les systèmes d'inférence de LLM

    673+5Évolution des étoiles sur les 7 derniers jours
  • efficientsam3@SimonZeng7108

    EfficientSAM3 compresse SAM3 en modèles légers et adaptés aux bords via une distillation progressive de connaissances pour une segmentation et un suivi de concepts rapides et promptables.

    668+9Évolution des étoiles sur les 7 derniers jours
  • FlashTTS@HuiResearch

    Basé sur des modèles tels que SparkTTS et OrpheusTTS, ce service fournit une synthèse vocale en chinois de haute qualité et un clonage de voix.

    614+1Évolution des étoiles sur les 7 derniers jours
  • RoboBrain@FlagOpen

    [CVPR 2025] RoboBrain : Un modèle de cerveau unifié pour la manipulation robotique, de l'abstrait au concret. Dépôt officiel.

    563+0Évolution des étoiles sur les 7 derniers jours
  • crater@raids-lab

    Crater est une plateforme cloud-native d'entraînement et d'inférence pour l'IA.

    554+2Évolution des étoiles sur les 7 derniers jours
  • vllm-playground@micytao

    Interface web moderne pour gérer et interagir avec les serveurs vLLM (www.github.com/vllm-project/vllm). Prend en charge les modes GPU et CPU, avec des optimisations spécifiques pour Apple Silicon sur macOS et le déploiement en entreprise sur OpenShift/Kubernetes.

    531+9Évolution des étoiles sur les 7 derniers jours
  • taOS@jaylfc

    Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).

    521+17Évolution des étoiles sur les 7 derniers jours
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    514Évolution des étoiles sur les 7 derniers jours
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    507Évolution des étoiles sur les 7 derniers jours
  • vllm-cli@Chen-zexi

    Un outil d'interface en ligne de commande pour servir des LLM en utilisant vLLM.

    505-1Évolution des étoiles sur les 7 derniers jours
← Retour aux sujets