vllm
Repositori open source terpantau bertanda vllm, diurutkan berdasarkan bintang.
- #31
Evaluasi respons LLM Anda dengan Prometheus dan GPT4 💯
★ 1.111+4Perubahan bintang dalam 7 hari terakhir - #32
Bangun mesin inferensi LLM berkinerja tinggi Anda sendiri dalam C++ dan CUDA - versi yang lebih kecil dari vLLM.
★ 1.094+15Perubahan bintang dalam 7 hari terakhir - #33★ 968+73Perubahan bintang dalam 7 hari terakhir
- #34★ 936+18Perubahan bintang dalam 7 hari terakhir
- #35
Catatan LLM, termasuk inferensi model, struktur model transformer, dan catatan analisis kode kerangka kerja LLM.
★ 890+2Perubahan bintang dalam 7 hari terakhir - #36
Roadmap 10 minggu, 30 menit per hari untuk inferensi dan pengoptimalan penyajian LLM. vLLM, SGLang, kuantisasi, decoding spekulatif, benchmarking.
★ 882+78Perubahan bintang dalam 7 hari terakhir - #37
Perangkat lunak OCR lokal, offline (setelah pengaturan awal), dan portabel yang dapat memproses gambar serta file PDF, menggunakan AI DeepSeek-OCR-2 (berjalan langsung di mesin Anda).
★ 874+4Perubahan bintang dalam 7 hari terakhir - #38
Dokumentasi ujung-ke-ujung untuk menyiapkan server LLM lokal & sepenuhnya privat Anda di Debian. Dilengkapi dengan obrolan, pencarian web, RAG, manajemen model, server MCP, pembuatan gambar, dan TTS.
★ 834-2Perubahan bintang dalam 7 hari terakhir - #39
Jadikan Discord frontend LLM Anda - Mendukung API apa pun yang kompatibel dengan OpenAI (OpenRouter, Ollama, dan lainnya)
★ 830+5Perubahan bintang dalam 7 hari terakhir - #40
Pustaka Python yang didukung oleh Model Bahasa (LLM) untuk penemuan dan analisis data percakapan.
★ 787+1Perubahan bintang dalam 7 hari terakhir - #41
[EMNLP 2024 & AAAI 2026] Toolkit canggih untuk mengompresi model besar termasuk LLM, VLM, dan model generatif video.
★ 747+4Perubahan bintang dalam 7 hari terakhir - #42
Mesin inferensi LLM murni Rust + CUDA — tanpa PyTorch, kompatibel dengan OpenAI, melayani Qwen3 hingga Kimi-K2
★ 676+17Perubahan bintang dalam 7 hari terakhir - #43
Simulator yang akurat, berskala besar, dan dapat diperluas untuk sistem inferensi LLM
★ 673+5Perubahan bintang dalam 7 hari terakhir - #44
EfficientSAM3 mengompresi SAM3 menjadi model ringan yang ramah perangkat edge melalui distilasi pengetahuan progresif untuk segmentasi dan pelacakan konsep yang cepat.
★ 667+9Perubahan bintang dalam 7 hari terakhir - #45
Berdasarkan model seperti SparkTTS dan OrpheusTTS, menyediakan layanan sintesis suara Tiongkok dan kloning suara berkualitas tinggi.
★ 614+1Perubahan bintang dalam 7 hari terakhir - #46
[CVPR 2025] RoboBrain: Model Otak Terpadu untuk Manipulasi Robot dari Abstrak ke Konkret. Repositori Resmi.
★ 563+0Perubahan bintang dalam 7 hari terakhir - #47★ 554+2Perubahan bintang dalam 7 hari terakhir
- #48
Antarmuka web modern untuk mengelola dan berinteraksi dengan server vLLM (www.github.com/vllm-project/vllm). Mendukung mode GPU dan CPU, dengan pengoptimalan khusus untuk macOS Apple Silicon dan penerapan perusahaan di OpenShift/Kubernetes.
★ 531+9Perubahan bintang dalam 7 hari terakhir - #49
Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).
★ 521+17Perubahan bintang dalam 7 hari terakhir - #50
Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.
★ 514—Perubahan bintang dalam 7 hari terakhir - #51
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 507—Perubahan bintang dalam 7 hari terakhir - #52★ 505-1Perubahan bintang dalam 7 hari terakhir