Pular para o conteúdo principal
buildradar
Sign in
Tópico · vllm

vllm

Repositórios de código aberto acompanhados marcados com vllm, ordenados por estrelas.

52 repositórios
  • prometheus-eval@prometheus-eval

    Avalie a resposta do seu LLM com Prometheus e GPT4 💯

    1.111+4Variação de estrelas nos últimos 7 dias
  • tiny-vllm@jmaczan

    Construa seu próprio motor de inferência LLM de alto desempenho em C++ e CUDA - uma versão reduzida do vLLM.

    1.094+15Variação de estrelas nos últimos 7 dias
  • verl-omni@verl-project

    Framework de treinamento de RL multimodal para modelos de difusão e omni

    983+73Variação de estrelas nos últimos 7 dias
  • UniRL@Tencent-Hunyuan

    UniRL é um framework para aprendizado por reforço de modelos multimodais unificados

    939+18Variação de estrelas nos últimos 7 dias
  • llm_note@harleyszhang

    Notas sobre LLM, incluindo inferência de modelos, estrutura de modelos transformer e notas de análise de código de frameworks de LLM.

    890+2Variação de estrelas nos últimos 7 dias
  • Um roteiro de 10 semanas, com 30 minutos por dia, para inferência e otimização de LLMs. vLLM, SGLang, quantização, decodificação especulativa, benchmarking.

    887+78Variação de estrelas nos últimos 7 dias
  • local_ai_ocr@th1nhhdk

    Um software de OCR local, offline (após a configuração inicial) e portátil que pode processar imagens e arquivos PDF, usando DeepSeek-OCR-2 AI (executado diretamente na sua máquina).

    874+4Variação de estrelas nos últimos 7 dias
  • llm-server-docs@varunvasudeva1

    Documentação completa de ponta a ponta para configurar seu próprio servidor LLM local e totalmente privado no Debian. Equipado com chat, busca web, RAG, gerenciamento de modelos, servidores MCP, geração de imagens e TTS.

    833-2Variação de estrelas nos últimos 7 dias
  • llmcord@jakobdylanc

    Torne o Discord seu frontend de LLM - Suporta qualquer API compatível com OpenAI (OpenRouter, Ollama e mais)

    830+5Variação de estrelas nos últimos 7 dias
  • BambooAI@pgalko

    Uma biblioteca Python alimentada por Modelos de Linguagem (LLMs) para descoberta e análise de dados conversacionais.

    787+1Variação de estrelas nos últimos 7 dias
  • LightCompress@ModelTC

    [EMNLP 2024 & AAAI 2026] Um poderoso kit de ferramentas para compressão de grandes modelos, incluindo LLMs, VLMs e modelos gerativos de vídeo.

    747+4Variação de estrelas nos últimos 7 dias
  • pegainfer@pegainfer-project

    Mecanismo de inferência de LLM em Pure Rust + CUDA — sem PyTorch, compatível com OpenAI, serve de Qwen3 a Kimi-K2

    678+17Variação de estrelas nos últimos 7 dias
  • vidur@microsoft

    Simulador preciso, em larga escala e extensível para sistemas de inferência de LLM

    673+5Variação de estrelas nos últimos 7 dias
  • efficientsam3@SimonZeng7108

    O EfficientSAM3 comprime o SAM3 em modelos leves e adequados para borda por meio de destilação de conhecimento progressiva para segmentação e rastreamento de conceitos rápidos e prontos para comandos.

    668+9Variação de estrelas nos últimos 7 dias
  • FlashTTS@HuiResearch

    Com base em modelos como SparkTTS e OrpheusTTS, fornece serviços de clonagem de voz e síntese de fala em chinês de alta qualidade.

    614+1Variação de estrelas nos últimos 7 dias
  • RoboBrain@FlagOpen

    [CVPR 2025] RoboBrain: Um modelo cerebral unificado para manipulação robótica do abstrato ao concreto. Repositório oficial.

    563+0Variação de estrelas nos últimos 7 dias
  • crater@raids-lab

    Crater é uma plataforma nativa da nuvem para treinamento e inferência de IA.

    554+2Variação de estrelas nos últimos 7 dias
  • vllm-playground@micytao

    Uma interface web moderna para gerenciar e interagir com servidores vLLM (www.github.com/vllm-project/vllm). Suporta modos GPU e CPU, com otimizações especiais para macOS Apple Silicon e implantação corporativa no OpenShift/Kubernetes.

    531+9Variação de estrelas nos últimos 7 dias
  • taOS@jaylfc

    Self-hosted AI agent OS. Your memory, chat, agents, and files stay on hardware you own, offline by default, cloud by choice. Offline AI memory (taOSmd), self-hosted multi-framework group chat, a full web desktop + app store, and auto-clustering across the consumer hardware you already have (Orange/Raspberry Pi, Mac mini, gaming PC).

    521+17Variação de estrelas nos últimos 7 dias
  • smg@smg-project

    Engine-agnostic LLM gateway in Rust. Full OpenAI & Anthropic API compatibility across vLLM, TRT-LLM, TokenSpeed, SGLang, OpenAI, Gemini & more. Industry-first gRPC pipeline, KV cache-aware routing, chat history, tokenization caching, Responses API, embeddings, WASM plugins, MCP, and multi-tenant auth.

    514Variação de estrelas nos últimos 7 dias
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    507Variação de estrelas nos últimos 7 dias
  • vllm-cli@Chen-zexi

    Uma ferramenta de interface de linha de comando para servir LLM usando vLLM.

    505-1Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos