Pular para o conteúdo principal
buildradar
Sign in
Tópico · model-serving

model-serving

Repositórios de código aberto acompanhados marcados com model-serving, ordenados por estrelas.

Repositórios
30
Total de estrelas
164.226
Média de estrelas
5.474
Participação
0,01%

Tópicos que aparecem com frequência ao lado de model-serving no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com model-serving.

Nenhum repositório novo marcado com este tópico nos últimos 90 dias.

  • vllm@vllm-project

    Um mecanismo de inferência e atendimento de alto rendimento e eficiente em memória para LLMs

    90.415+745Variação de estrelas nos últimos 7 dias
  • BentoML@bentoml

    A maneira mais fácil de servir aplicativos e modelos de IA - Crie APIs de inferência de modelos, filas de tarefas, aplicativos de LLM, pipelines multimodelo e muito mais!

    8.813+18Variação de estrelas nos últimos 7 dias
  • vllm-omni@vllm-project

    Um framework para inferência eficiente de modelos com modelos de omnimodalidade

    6.457+229Variação de estrelas nos últimos 7 dias
  • kserve@kserve

    Plataforma padronizada de inferência de IA generativa e preditiva distribuída para implantação escalável em múltiplos frameworks no Kubernetes.

    5.840+25Variação de estrelas nos últimos 7 dias
  • Olares@beclab

    Sistema operacional de nuvem pessoal de código aberto para agentes sempre ativos.

    5.243+10Variação de estrelas nos últimos 7 dias
  • Neste repositório, compartilharei algumas notas e referências úteis sobre como implantar modelos baseados em aprendizado profundo em produção.

    4.376+1Variação de estrelas nos últimos 7 dias
  • 🚀 Awesome System for Machine Learning ⚡️ Artigos sobre sistemas de IA e práticas da indústria. ⚡️ Sistemas para Machine Learning, LLM (Large Language Model), GenAI (Generative AI). 🍻 OSDI, NSDI, SIGCOMM, SoCC, MLSys, etc. 🗃️ Llama3, Mistral, etc. 🧑‍💻 Tutoriais em vídeo.

    4.318+27Variação de estrelas nos últimos 7 dias
  • LightLLM@ModelTC

    LightLLM é um framework de inferência e atendimento para LLMs (Modelos de Linguagem Grande) baseado em Python, notável por seu design leve, fácil escalabilidade e alto desempenho.

    4.251+21Variação de estrelas nos últimos 7 dias
  • FedML@FedML-AI

    FEDML - A biblioteca de ML unificada e escalável para treinamento distribuído em larga escala, serviço de modelos e aprendizado federado. O FEDML Launch, um agendador cross-cloud, permite executar qualquer trabalho de IA em qualquer nuvem de GPU ou cluster local. Construída sobre esta biblioteca, a TensorOpera AI (https://TensorOpera.ai) é sua plataforma de IA generativa em escala.

    4.061-1Variação de estrelas nos últimos 7 dias
  • lorax@predibase

    Servidor de inferência Multi-LoRA que escala para milhares de LLMs ajustados

    3.826-2Variação de estrelas nos últimos 7 dias
  • chitu@thu-pacman

    Framework de inferência de alto desempenho para grandes modelos de linguagem, com foco em eficiência, flexibilidade e disponibilidade.

    2.998+5Variação de estrelas nos últimos 7 dias
  • vllm-ascend@vllm-project

    Plugin de hardware mantido pela comunidade para vLLM em Ascend.

    2.730+53Variação de estrelas nos últimos 7 dias
  • openlake@openlake-project

    OpenLake é um motor de armazenamento de alto desempenho para inferência eficiente de LLM e treinamento em GPU

    2.346+9Variação de estrelas nos últimos 7 dias
  • envd@tensorchord

    Ambiente de desenvolvimento reproduzível para humanos e agentes

    2.227+3Variação de estrelas nos últimos 7 dias
  • aici@microsoft

    AICI: Prompts como Programas (Wasm)

    2.076+0Variação de estrelas nos últimos 7 dias
  • mlrun@mlrun

    MLRun é uma plataforma MLOps de código aberto para construir e gerenciar rapidamente aplicações de ML contínuas ao longo de seu ciclo de vida. O MLRun integra-se ao seu ambiente de desenvolvimento e CI/CD, automatizando a entrega de dados de produção, pipelines de ML e aplicações online.

    1.694+0Variação de estrelas nos últimos 7 dias
  • kitops@kitops-ml

    Uma ferramenta DevOps de código aberto da CNCF para empacotar e versionar modelos de IA/ML, conjuntos de dados, código e configurações em um OCI Artifact.

    1.409+5Variação de estrelas nos últimos 7 dias
  • rtp-llm@alibaba

    RTP-LLM: motor de inferência LLM de alto desempenho da Alibaba para diversas aplicações.

    1.320+6Variação de estrelas nos últimos 7 dias
  • hopsworks@logicalclocks

    Hopsworks - Plataforma de IA intensiva em dados com um Feature Store

    1.303+1Variação de estrelas nos últimos 7 dias
  • truss@basetenlabs

    A maneira mais simples de servir modelos de IA/ML em produção

    1.196+1Variação de estrelas nos últimos 7 dias
  • sglang-omni@sgl-project

    O SGLang-Omni capacita o atendimento de alto desempenho para modelos TTS, ASR, de fala e onidirecionais.

    978+70Variação de estrelas nos últimos 7 dias
  • Nanoflow@efeslab

    Uma estrutura de atendimento de alto desempenho orientada a vazão para LLMs

    974+0Variação de estrelas nos últimos 7 dias
  • model_server@openvinotoolkit

    Servidor de inferência escalável para modelos otimizados com OpenVINO™

    921+3Variação de estrelas nos últimos 7 dias
  • ZhiLight@zhihu

    Um motor de aceleração de inferência de LLM altamente otimizado para Llama e suas variantes.

    908+0Variação de estrelas nos últimos 7 dias
  • mosec@mosecorg

    Um framework de atendimento de modelos ML de alto desempenho, oferece loteamento dinâmico e pipelines de CPU/GPU para explorar totalmente sua máquina de computação

    902+0Variação de estrelas nos últimos 7 dias
  • ServerlessLLM@ServerlessLLM

    Serviço de LLM serverless para todos.

    711+6Variação de estrelas nos últimos 7 dias
  • timber@kossisoroyce

    Ollama para modelos de ML clássicos. Compilador AOT que transforma modelos XGBoost, LightGBM, scikit-learn, CatBoost e ONNX em código de inferência C99 nativo. Um comando para carregar, um comando para servir. 336x mais rápido que a inferência em Python.

    687-1Variação de estrelas nos últimos 7 dias
  • pegainfer@pegainfer-project

    Mecanismo de inferência de LLM em Pure Rust + CUDA — sem PyTorch, compatível com OpenAI, serve de Qwen3 a Kimi-K2

    660+4Variação de estrelas nos últimos 7 dias
  • fastapi-ml-skeleton@eightBEC

    Aplicação esqueleto em FastAPI para servir modelos de aprendizado de máquina prontos para produção.

    603-1Variação de estrelas nos últimos 7 dias
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    502Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos