Lompat ke konten utama
buildradar
Sign in
Topik · vllm

vllm

Repositori open source terpantau bertanda vllm, diurutkan berdasarkan bintang.

52 repositori
  • prometheus-eval@prometheus-eval

    Evaluasi respons LLM Anda dengan Prometheus dan GPT4 💯

    1.111+4Perubahan bintang dalam 7 hari terakhir
  • tiny-vllm@jmaczan

    Bangun mesin inferensi LLM berkinerja tinggi Anda sendiri dalam C++ dan CUDA - versi yang lebih kecil dari vLLM.

    1.094+15Perubahan bintang dalam 7 hari terakhir
  • verl-omni@verl-project

    Kerangka kerja pelatihan RL multimodal untuk model diffusion & omni

    968+73Perubahan bintang dalam 7 hari terakhir
  • UniRL@Tencent-Hunyuan

    UniRL adalah framework untuk Reinforcement Learning Model Multimodal Terpadu

    936+18Perubahan bintang dalam 7 hari terakhir
  • llm_note@harleyszhang

    Catatan LLM, termasuk inferensi model, struktur model transformer, dan catatan analisis kode kerangka kerja LLM.

    890+2Perubahan bintang dalam 7 hari terakhir
  • Roadmap 10 minggu, 30 menit per hari untuk inferensi dan pengoptimalan penyajian LLM. vLLM, SGLang, kuantisasi, decoding spekulatif, benchmarking.

    882+78Perubahan bintang dalam 7 hari terakhir
  • local_ai_ocr@th1nhhdk

    Perangkat lunak OCR lokal, offline (setelah pengaturan awal), dan portabel yang dapat memproses gambar serta file PDF, menggunakan AI DeepSeek-OCR-2 (berjalan langsung di mesin Anda).

    874+4Perubahan bintang dalam 7 hari terakhir
  • llm-server-docs@varunvasudeva1

    Dokumentasi ujung-ke-ujung untuk menyiapkan server LLM lokal & sepenuhnya privat Anda di Debian. Dilengkapi dengan obrolan, pencarian web, RAG, manajemen model, server MCP, pembuatan gambar, dan TTS.

    834-2Perubahan bintang dalam 7 hari terakhir
  • llmcord@jakobdylanc

    Jadikan Discord frontend LLM Anda - Mendukung API apa pun yang kompatibel dengan OpenAI (OpenRouter, Ollama, dan lainnya)

    830+5Perubahan bintang dalam 7 hari terakhir
  • BambooAI@pgalko

    Pustaka Python yang didukung oleh Model Bahasa (LLM) untuk penemuan dan analisis data percakapan.

    787+1Perubahan bintang dalam 7 hari terakhir
  • LightCompress@ModelTC

    [EMNLP 2024 & AAAI 2026] Toolkit canggih untuk mengompresi model besar termasuk LLM, VLM, dan model generatif video.

    747+4Perubahan bintang dalam 7 hari terakhir
  • pegainfer@pegainfer-project

    Mesin inferensi LLM murni Rust + CUDA — tanpa PyTorch, kompatibel dengan OpenAI, melayani Qwen3 hingga Kimi-K2

    676+17Perubahan bintang dalam 7 hari terakhir
  • vidur@microsoft

    Simulator yang akurat, berskala besar, dan dapat diperluas untuk sistem inferensi LLM

    673+5Perubahan bintang dalam 7 hari terakhir
  • efficientsam3@SimonZeng7108

    EfficientSAM3 mengompresi SAM3 menjadi model ringan yang ramah perangkat edge melalui distilasi pengetahuan progresif untuk segmentasi dan pelacakan konsep yang cepat.

    667+9Perubahan bintang dalam 7 hari terakhir
  • FlashTTS@HuiResearch

    Berdasarkan model seperti SparkTTS dan OrpheusTTS, menyediakan layanan sintesis suara Tiongkok dan kloning suara berkualitas tinggi.

    614+1Perubahan bintang dalam 7 hari terakhir
  • RoboBrain@FlagOpen

    [CVPR 2025] RoboBrain: Model Otak Terpadu untuk Manipulasi Robot dari Abstrak ke Konkret. Repositori Resmi.

    563+0Perubahan bintang dalam 7 hari terakhir
  • crater@raids-lab

    Crater adalah platform pelatihan & inferensi AI berbasis cloud-native.

    554+2Perubahan bintang dalam 7 hari terakhir
  • vllm-playground@micytao

    Antarmuka web modern untuk mengelola dan berinteraksi dengan server vLLM (www.github.com/vllm-project/vllm). Mendukung mode GPU dan CPU, dengan pengoptimalan khusus untuk macOS Apple Silicon dan penerapan perusahaan di OpenShift/Kubernetes.

    531+9Perubahan bintang dalam 7 hari terakhir
  • taOS@jaylfc

    Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).

    521+17Perubahan bintang dalam 7 hari terakhir
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    514Perubahan bintang dalam 7 hari terakhir
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    507Perubahan bintang dalam 7 hari terakhir
  • vllm-cli@Chen-zexi

    Alat antarmuka baris perintah (CLI) untuk menyajikan LLM menggunakan vLLM.

    505-1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik