vllm
Erfasste Open-Source-Repos mit dem Tag vllm, sortiert nach Sternen.
- #31
Bewerten Sie die Antworten Ihres LLM mit Prometheus und GPT4 💯
★ 1.111+0Sterne-Änderung der letzten 7 Tage - #32
Baue deine eigene performante LLM-Inferenz-Engine in C++ und CUDA – eine kleinere Version von vLLM
★ 1.094+9Sterne-Änderung der letzten 7 Tage - #33★ 955+56Sterne-Änderung der letzten 7 Tage
- #34
UniRL ist ein Framework für das Reinforcement Learning multimodaler Einheitsmodelle
★ 933+7Sterne-Änderung der letzten 7 Tage - #35
LLM-Notizen einschließlich Modellinferenz, Transformer-Modellstruktur und Quellcodeanalyse von LLM-Frameworks.
★ 889+1Sterne-Änderung der letzten 7 Tage - #36
Ein 10-wöchiger, 30 Minuten pro Tag umfassender Fahrplan für LLM-Inferenz-Serving und -Optimierung. vLLM, SGLang, Quantisierung, spekulatives Decoding, Benchmarking.
★ 880+100Sterne-Änderung der letzten 7 Tage - #37
Eine lokale, nach der Ersteinrichtung offline nutzbare, portable OCR-Software zur Verarbeitung von Bildern und PDF-Dateien unter Verwendung von DeepSeek-OCR-2 AI (läuft direkt auf deinem Computer).
★ 873+3Sterne-Änderung der letzten 7 Tage - #38
End-to-End-Dokumentation zur Einrichtung eines eigenen, lokalen und vollständig privaten LLM-Servers auf Debian. Ausgestattet mit Chat, Websuche, RAG, Modellverwaltung, MCP-Servern, Bildgenerierung und TTS.
★ 834+2Sterne-Änderung der letzten 7 Tage - #39
Machen Sie Discord zu Ihrem LLM-Frontend – Unterstützt jede OpenAI-kompatible API (OpenRouter, Ollama und mehr)
★ 829+3Sterne-Änderung der letzten 7 Tage - #40
Eine Python-Bibliothek, angetrieben von Sprachmodellen (LLMs), für die konversationelle Datenerkennung und -analyse.
★ 787+0Sterne-Änderung der letzten 7 Tage - #41
[EMNLP 2024 & AAAI 2026] Ein leistungsstarkes Toolkit zur Komprimierung großer Modelle einschließlich LLMs, VLMs und Video-Generierungsmodellen.
★ 747+1Sterne-Änderung der letzten 7 Tage - #42
Reines Rust + CUDA LLM-Inferenz-Engine — kein PyTorch, OpenAI-kompatibel, bedient Qwen3 bis Kimi-K2
★ 673+13Sterne-Änderung der letzten 7 Tage - #43★ 672+5Sterne-Änderung der letzten 7 Tage
- #44
EfficientSAM3 komprimiert SAM3 durch progressive Wissensdestillation in leichtgewichtige, Edge-freundliche Modelle für schnelle, prompt-basierte Konzeptsegmentierung und -verfolgung.
★ 666+4Sterne-Änderung der letzten 7 Tage - #45
Bietet hochwertige chinesische Sprachsynthese und Stimmklon-Dienste auf Basis von Modellen wie SparkTTS und OrpheusTTS.
★ 613+0Sterne-Änderung der letzten 7 Tage - #46
[CVPR 2025] RoboBrain: Ein einheitliches Gehirnmodell für die Roboter-Manipulation von abstrakt bis konkret. Offizielles Repository.
★ 564+1Sterne-Änderung der letzten 7 Tage - #47★ 553+1Sterne-Änderung der letzten 7 Tage
- #48
Ein modernes Web-Interface zur Verwaltung und Interaktion mit vLLM-Servern. Unterstützt GPU- und CPU-Modi mit speziellen Optimierungen für Apple Silicon unter macOS sowie für Enterprise-Deployments auf OpenShift/Kubernetes.
★ 529+9Sterne-Änderung der letzten 7 Tage - #49
Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).
★ 514—Sterne-Änderung der letzten 7 Tage - #50
Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.
★ 508—Sterne-Änderung der letzten 7 Tage - #51★ 506+0Sterne-Änderung der letzten 7 Tage
- #52
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 505—Sterne-Änderung der letzten 7 Tage