vllm
Repositórios de código aberto acompanhados marcados com vllm, ordenados por estrelas.
- #31
Avalie a resposta do seu LLM com Prometheus e GPT4 💯
★ 1.111+4Variação de estrelas nos últimos 7 dias - #32
Construa seu próprio motor de inferência LLM de alto desempenho em C++ e CUDA - uma versão reduzida do vLLM.
★ 1.094+15Variação de estrelas nos últimos 7 dias - #33★ 983+73Variação de estrelas nos últimos 7 dias
- #34
UniRL é um framework para aprendizado por reforço de modelos multimodais unificados
★ 939+18Variação de estrelas nos últimos 7 dias - #35
Notas sobre LLM, incluindo inferência de modelos, estrutura de modelos transformer e notas de análise de código de frameworks de LLM.
★ 890+2Variação de estrelas nos últimos 7 dias - #36
Um roteiro de 10 semanas, com 30 minutos por dia, para inferência e otimização de LLMs. vLLM, SGLang, quantização, decodificação especulativa, benchmarking.
★ 887+78Variação de estrelas nos últimos 7 dias - #37
Um software de OCR local, offline (após a configuração inicial) e portátil que pode processar imagens e arquivos PDF, usando DeepSeek-OCR-2 AI (executado diretamente na sua máquina).
★ 874+4Variação de estrelas nos últimos 7 dias - #38
Documentação completa de ponta a ponta para configurar seu próprio servidor LLM local e totalmente privado no Debian. Equipado com chat, busca web, RAG, gerenciamento de modelos, servidores MCP, geração de imagens e TTS.
★ 833-2Variação de estrelas nos últimos 7 dias - #39
Torne o Discord seu frontend de LLM - Suporta qualquer API compatível com OpenAI (OpenRouter, Ollama e mais)
★ 830+5Variação de estrelas nos últimos 7 dias - #40
Uma biblioteca Python alimentada por Modelos de Linguagem (LLMs) para descoberta e análise de dados conversacionais.
★ 787+1Variação de estrelas nos últimos 7 dias - #41
[EMNLP 2024 & AAAI 2026] Um poderoso kit de ferramentas para compressão de grandes modelos, incluindo LLMs, VLMs e modelos gerativos de vídeo.
★ 747+4Variação de estrelas nos últimos 7 dias - #42
Mecanismo de inferência de LLM em Pure Rust + CUDA — sem PyTorch, compatível com OpenAI, serve de Qwen3 a Kimi-K2
★ 678+17Variação de estrelas nos últimos 7 dias - #43★ 673+5Variação de estrelas nos últimos 7 dias
- #44
O EfficientSAM3 comprime o SAM3 em modelos leves e adequados para borda por meio de destilação de conhecimento progressiva para segmentação e rastreamento de conceitos rápidos e prontos para comandos.
★ 668+9Variação de estrelas nos últimos 7 dias - #45
Com base em modelos como SparkTTS e OrpheusTTS, fornece serviços de clonagem de voz e síntese de fala em chinês de alta qualidade.
★ 614+1Variação de estrelas nos últimos 7 dias - #46
[CVPR 2025] RoboBrain: Um modelo cerebral unificado para manipulação robótica do abstrato ao concreto. Repositório oficial.
★ 563+0Variação de estrelas nos últimos 7 dias - #47★ 554+2Variação de estrelas nos últimos 7 dias
- #48
Uma interface web moderna para gerenciar e interagir com servidores vLLM (www.github.com/vllm-project/vllm). Suporta modos GPU e CPU, com otimizações especiais para macOS Apple Silicon e implantação corporativa no OpenShift/Kubernetes.
★ 531+9Variação de estrelas nos últimos 7 dias - #49
Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).
★ 521+17Variação de estrelas nos últimos 7 dias - #50
Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.
★ 514—Variação de estrelas nos últimos 7 dias - #51
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 507—Variação de estrelas nos últimos 7 dias - #52★ 505-1Variação de estrelas nos últimos 7 dias