Zum Hauptinhalt springen
buildradar
Sign in
Thema · vllm

vllm

Erfasste Open-Source-Repos mit dem Tag vllm, sortiert nach Sternen.

52 Repos
  • prometheus-eval@prometheus-eval

    Bewerten Sie die Antworten Ihres LLM mit Prometheus und GPT4 💯

    1.111+0Sterne-Änderung der letzten 7 Tage
  • tiny-vllm@jmaczan

    Baue deine eigene performante LLM-Inferenz-Engine in C++ und CUDA – eine kleinere Version von vLLM

    1.094+9Sterne-Änderung der letzten 7 Tage
  • verl-omni@verl-project

    Multimodales RL-Trainingsframework für Diffusions- und Omni-Modelle

    955+56Sterne-Änderung der letzten 7 Tage
  • UniRL@Tencent-Hunyuan

    UniRL ist ein Framework für das Reinforcement Learning multimodaler Einheitsmodelle

    933+7Sterne-Änderung der letzten 7 Tage
  • llm_note@harleyszhang

    LLM-Notizen einschließlich Modellinferenz, Transformer-Modellstruktur und Quellcodeanalyse von LLM-Frameworks.

    889+1Sterne-Änderung der letzten 7 Tage
  • Ein 10-wöchiger, 30 Minuten pro Tag umfassender Fahrplan für LLM-Inferenz-Serving und -Optimierung. vLLM, SGLang, Quantisierung, spekulatives Decoding, Benchmarking.

    880+100Sterne-Änderung der letzten 7 Tage
  • local_ai_ocr@th1nhhdk

    Eine lokale, nach der Ersteinrichtung offline nutzbare, portable OCR-Software zur Verarbeitung von Bildern und PDF-Dateien unter Verwendung von DeepSeek-OCR-2 AI (läuft direkt auf deinem Computer).

    873+3Sterne-Änderung der letzten 7 Tage
  • llm-server-docs@varunvasudeva1

    End-to-End-Dokumentation zur Einrichtung eines eigenen, lokalen und vollständig privaten LLM-Servers auf Debian. Ausgestattet mit Chat, Websuche, RAG, Modellverwaltung, MCP-Servern, Bildgenerierung und TTS.

    834+2Sterne-Änderung der letzten 7 Tage
  • llmcord@jakobdylanc

    Machen Sie Discord zu Ihrem LLM-Frontend – Unterstützt jede OpenAI-kompatible API (OpenRouter, Ollama und mehr)

    829+3Sterne-Änderung der letzten 7 Tage
  • BambooAI@pgalko

    Eine Python-Bibliothek, angetrieben von Sprachmodellen (LLMs), für die konversationelle Datenerkennung und -analyse.

    787+0Sterne-Änderung der letzten 7 Tage
  • LightCompress@ModelTC

    [EMNLP 2024 & AAAI 2026] Ein leistungsstarkes Toolkit zur Komprimierung großer Modelle einschließlich LLMs, VLMs und Video-Generierungsmodellen.

    747+1Sterne-Änderung der letzten 7 Tage
  • pegainfer@pegainfer-project

    Reines Rust + CUDA LLM-Inferenz-Engine — kein PyTorch, OpenAI-kompatibel, bedient Qwen3 bis Kimi-K2

    673+13Sterne-Änderung der letzten 7 Tage
  • vidur@microsoft

    Präziser, skalierbarer und erweiterbarer Simulator für LLM-Inferenzsysteme

    672+5Sterne-Änderung der letzten 7 Tage
  • efficientsam3@SimonZeng7108

    EfficientSAM3 komprimiert SAM3 durch progressive Wissensdestillation in leichtgewichtige, Edge-freundliche Modelle für schnelle, prompt-basierte Konzeptsegmentierung und -verfolgung.

    666+4Sterne-Änderung der letzten 7 Tage
  • FlashTTS@HuiResearch

    Bietet hochwertige chinesische Sprachsynthese und Stimmklon-Dienste auf Basis von Modellen wie SparkTTS und OrpheusTTS.

    613+0Sterne-Änderung der letzten 7 Tage
  • RoboBrain@FlagOpen

    [CVPR 2025] RoboBrain: Ein einheitliches Gehirnmodell für die Roboter-Manipulation von abstrakt bis konkret. Offizielles Repository.

    564+1Sterne-Änderung der letzten 7 Tage
  • crater@raids-lab

    Crater ist eine Cloud-native Plattform für KI-Training und Inferenz.

    553+1Sterne-Änderung der letzten 7 Tage
  • vllm-playground@micytao

    Ein modernes Web-Interface zur Verwaltung und Interaktion mit vLLM-Servern. Unterstützt GPU- und CPU-Modi mit speziellen Optimierungen für Apple Silicon unter macOS sowie für Enterprise-Deployments auf OpenShift/Kubernetes.

    529+9Sterne-Änderung der letzten 7 Tage
  • taOS@jaylfc

    Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).

    514Sterne-Änderung der letzten 7 Tage
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    508Sterne-Änderung der letzten 7 Tage
  • vllm-cli@Chen-zexi

    Ein Kommandozeilen-Tool zur Bereitstellung von LLMs mittels vLLM.

    506+0Sterne-Änderung der letzten 7 Tage
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    505Sterne-Änderung der letzten 7 Tage
← Zurück zu den Themen