Pular para o conteúdo principal
buildradar
Sign in
Tópico · inference

inference

Repositórios de código aberto acompanhados marcados com inference, ordenados por estrelas.

Repositórios
117
Total de estrelas
769.346
Média de estrelas
6.576
Participação
0,04%

Tópicos que aparecem com frequência ao lado de inference no mesmo repositório.

Em ascensão recentemente

Repositórios criados nos últimos 90 dias e marcados com inference.

  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    10.552
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    513
  • vllm@vllm-project

    Um mecanismo de inferência e atendimento de alto rendimento e eficiente em memória para LLMs

    90.415+745Variação de estrelas nos últimos 7 dias
  • yolov5@ultralytics

    Ultralytics YOLOv5 em PyTorch para detecção de objetos, segmentação de instâncias, classificação, treinamento e exportação.

    57.939+20Variação de estrelas nos últimos 7 dias
  • whisper.cpp@ggml-org

    Port do modelo Whisper da OpenAI em C/C++

    53.286+193Variação de estrelas nos últimos 7 dias
  • DeepSpeed@deepspeedai

    O DeepSpeed é uma biblioteca de otimização de deep learning que torna o treinamento e a inferência distribuídos fáceis, eficientes e eficazes.

    43.019+44Variação de estrelas nos últimos 7 dias
  • ColossalAI@hpcaitech

    Tornando grandes modelos de IA mais baratos, rápidos e acessíveis

    41.446+8Variação de estrelas nos últimos 7 dias
  • mediapipe@google-ai-edge

    Soluções de ML multiplataforma e personalizáveis para mídia ao vivo e em streaming.

    36.769+83Variação de estrelas nos últimos 7 dias
  • sglang@sgl-project

    SGLang é um framework de atendimento de alto desempenho para grandes modelos de linguagem e modelos multimodais.

    32.747+503Variação de estrelas nos últimos 7 dias
  • faster-whisper@SYSTRAN

    Transcrição Whisper mais rápida com CTranslate2

    25.135+108Variação de estrelas nos últimos 7 dias
  • ncnn@Tencent

    ncnn é um framework de inferência de redes neurais de alto desempenho otimizado para plataformas móveis

    23.763+34Variação de estrelas nos últimos 7 dias
  • ml-engineering@stas00

    Livro aberto de engenharia de aprendizado de máquina.

    18.835+152Variação de estrelas nos últimos 7 dias
  • nano-vllm@GeeeekExplorer

    Nano vLLM

    15.218+137Variação de estrelas nos últimos 7 dias
  • ts-pattern@gvergnaud

    A biblioteca exaustiva de Pattern Matching para TypeScript, com inferência de tipos inteligente.

    15.141+10Variação de estrelas nos últimos 7 dias
  • TensorRT@NVIDIA

    NVIDIA® TensorRT™ é um SDK para inferência de deep learning de alto desempenho em GPUs NVIDIA. Este repositório contém os componentes de código aberto do TensorRT.

    13.305+32Variação de estrelas nos últimos 7 dias
  • LMCache@LMCache

    LMCache: Potencialize seu LLM com a camada de cache KV mais rápida

    11.562+256Variação de estrelas nos últimos 7 dias
  • amazon-sagemaker-examples@aws

    Exemplos de notebooks Jupyter que demonstram como construir, treinar e implantar modelos de aprendizado de máquina usando o Amazon SageMaker.

    10.981+2Variação de estrelas nos últimos 7 dias
  • server@triton-inference-server

    O Triton Inference Server fornece uma solução otimizada de inferência em nuvem e na borda.

    10.949+18Variação de estrelas nos últimos 7 dias
  • openvino@openvinotoolkit

    OpenVINO™ é um kit de ferramentas de código aberto para otimizar e implantar inferência de IA

    10.763+72Variação de estrelas nos últimos 7 dias
  • yolov3@ultralytics

    Implementação em PyTorch do YOLOv3, YOLOv3-SPP e YOLOv3-tiny para detecção de objetos em tempo real, com treinamento, validação, inferência e exportação em múltiplos formatos.

    10.599+4Variação de estrelas nos últimos 7 dias
  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    10.552Variação de estrelas nos últimos 7 dias
  • runanywhere-sdks@RunanywhereAI

    Kit de ferramentas pronto para produção para executar IA localmente.

    10.280-12Variação de estrelas nos últimos 7 dias
  • inference@xorbitsai

    Troque o GPT por qualquer LLM alterando apenas uma linha de código. O Xinference permite executar modelos de código aberto, de fala e multimodais na nuvem, localmente ou no seu laptop — tudo através de uma API de inferência unificada e pronta para produção.

    9.528+21Variação de estrelas nos últimos 7 dias
  • oumi@oumi-ai

    Faça o ajuste fino, avalie e implante facilmente Qwen, Gemma ou qualquer LLM de pesos abertos!

    9.380+3Variação de estrelas nos últimos 7 dias
  • Guia Hello AI World para implantar redes de inferência de deep learning e primitivas de visão computacional com TensorRT e NVIDIA Jetson.

    8.974+6Variação de estrelas nos últimos 7 dias
  • io-ts@gcanti

    Sistema de tipos em tempo de execução para decodificação/codificação de E/S

    6.809+1Variação de estrelas nos últimos 7 dias
  • vllm-omni@vllm-project

    Um framework para inferência eficiente de modelos com modelos de omnimodalidade

    6.457+229Variação de estrelas nos últimos 7 dias
  • Mooncake@kvcache-ai

    Mooncake é a plataforma de serviço para o Kimi, um serviço de LLM líder fornecido pela Moonshot AI.

    6.430+90Variação de estrelas nos últimos 7 dias
  • argmax-oss-swift@argmaxinc

    IA de fala executada localmente no dispositivo para Apple Silicon

    6.345+11Variação de estrelas nos últimos 7 dias
  • Adversarial Robustness Toolbox (ART) - Biblioteca Python para segurança em Machine Learning - Evasão, Envenenamento, Extração, Inferência - Red e Blue Teams

    6.210+20Variação de estrelas nos últimos 7 dias
  • gpustack@gpustack

    Um gerenciador de cluster de GPU para servir modelos de IA de alto desempenho (vLLM, SGLang) e instâncias de GPU acessíveis via SSH sob demanda.

    5.572+37Variação de estrelas nos últimos 7 dias
  • semantic-router@vllm-project

    Um roteador programável de Mistura de Modelos (Mixture-of-Models) para inferência heterogênea de LLM

    5.405+190Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos