Pular para o conteúdo principal
buildradar
Sign in
Tópico · inference

inference

Repositórios de código aberto acompanhados marcados com inference, ordenados por estrelas.

120 repositórios
  • tensorrt-cpp-api@cyrusbehr

    Tutorial da API C++ do TensorRT

    811+0Variação de estrelas nos últimos 7 dias
  • cppflow@serizba

    Execute modelos do TensorFlow em C++ sem instalação e sem o Bazel

    803+0Variação de estrelas nos últimos 7 dias
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    783Variação de estrelas nos últimos 7 dias
  • filetype.py@h2non

    Pacote Python pequeno, rápido e sem dependências para inferir tipos de arquivos binários verificando a assinatura dos números mágicos

    773+3Variação de estrelas nos últimos 7 dias
  • studio-lab-examples@aws

    Notebooks de exemplo para trabalhar com o SageMaker Studio Lab. Inscreva-se para uma conta no link abaixo!

    772+1Variação de estrelas nos últimos 7 dias
  • APT@rnchg

    Ferramenta de produtividade de IA - Gratuita e de código aberto, melhora a produtividade do usuário e protege a privacidade e a segurança dos dados. Incluindo, mas não limitado a: modelos locais integrados como ChatGPT, DeepSeek, Phi, Qwen e outros, processamento inteligente em lote com um clique de imagens, vídeos, áudio, etc.

    768-1Variação de estrelas nos últimos 7 dias
  • SwiftLM@SharpAI

    ⚡ Servidor de inferência LLM nativo em MLX Swift para Apple Silicon. API compatível com OpenAI, streaming SSD para modelos MoE 100B+, compressão de cache KV TurboQuant, aplicativo para macOS e iOS iPhone.

    760+8Variação de estrelas nos últimos 7 dias
  • InferLLM@MegEngine

    Um framework leve para inferência de modelos LLM

    753+0Variação de estrelas nos últimos 7 dias
  • emlearn@emlearn

    Mecanismo de inferência de Machine Learning para microcontroladores e dispositivos embarcados

    753+5Variação de estrelas nos últimos 7 dias
  • identYwaf@stamparm

    Ferramenta de identificação cega de WAF.

    748+3Variação de estrelas nos últimos 7 dias
  • yolort@zhiqwang

    O yolort é uma pilha de execução para o yolov5 em aceleradores especializados, como tensorrt, libtorch, onnxruntime, tvm e ncnn.

    730+0Variação de estrelas nos últimos 7 dias
  • ml_privacy_meter@privacytrustlab

    Privacy Meter: Uma biblioteca de código aberto para auditar a privacidade de dados em algoritmos estatísticos e de machine learning.

    725+1Variação de estrelas nos últimos 7 dias
  • kglab@DerwenAI

    Graph Data Science: uma camada de abstração em Python para construir grafos de conhecimento, integrada com bibliotecas de grafos populares – sobre Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow, etc.

    691+2Variação de estrelas nos últimos 7 dias
  • timber@kossisoroyce

    Ollama para modelos de ML clássicos. Compilador AOT que transforma modelos XGBoost, LightGBM, scikit-learn, CatBoost e ONNX em código de inferência C99 nativo. Um comando para carregar, um comando para servir. 336x mais rápido que a inferência em Python.

    687+0Variação de estrelas nos últimos 7 dias
  • TrainYourOwnYOLO@AntonMu

    Treine um detector de objetos yolov3 de última geração do zero!

    677+0Variação de estrelas nos últimos 7 dias
  • pegainfer@pegainfer-project

    Mecanismo de inferência de LLM em Pure Rust + CUDA — sem PyTorch, compatível com OpenAI, serve de Qwen3 a Kimi-K2

    676+17Variação de estrelas nos últimos 7 dias
  • vidur@microsoft

    Simulador preciso, em larga escala e extensível para sistemas de inferência de LLM

    673+5Variação de estrelas nos últimos 7 dias
  • libonnx@xboot

    Um mecanismo de inferência onnx em puro C99, leve e portátil, para dispositivos embarcados com suporte a aceleração de hardware.

    652+0Variação de estrelas nos últimos 7 dias
  • waverless@WaveSpeedAI

    Orquestração de tarefas de GPU serverless de alto desempenho — a camada de agendamento por trás de wavespeed.ai

    632+0Variação de estrelas nos últimos 7 dias
  • Deepdive-llama3-from-scratch@therealoliver

    Implemente a inferência do llama3 passo a passo, compreenda os conceitos centrais, domine a derivação do processo e escreva o código.

    630+0Variação de estrelas nos últimos 7 dias
  • dlstreamer@open-edge-platform

    O Deep Learning Streamer (DL Streamer) Pipeline Framework é um framework de análise de mídia de streaming de código aberto, baseado no framework multimídia GStreamer*, para criar pipelines complexos de análise de mídia para a nuvem ou na borda (Edge).

    622-1Variação de estrelas nos últimos 7 dias
  • converta o modelo mmdetection para tensorrt, com suporte a fp16, int8, entrada em lote, formato dinâmico, etc.

    596+0Variação de estrelas nos últimos 7 dias
  • inferoa@agentic-in

    Inference-native Tokenmaxxing Agent Harness for Loop Engineering

    561Variação de estrelas nos últimos 7 dias
  • Biblioteca Python para detecção de pequenos objetos e segmentação de instâncias com YOLO

    557+0Variação de estrelas nos últimos 7 dias
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    548Variação de estrelas nos últimos 7 dias
  • aikit@kaito-project

    🏗️ Faça ajuste fino, construa e implante LLMs de código aberto facilmente!

    539+2Variação de estrelas nos últimos 7 dias
  • kubedl@kubedl-io

    Execute suas cargas de trabalho de deep learning no Kubernetes com mais facilidade e eficiência.

    532+1Variação de estrelas nos últimos 7 dias
  • model_analyzer@triton-inference-server

    Triton Model Analyzer é uma ferramenta de linha de comando para ajudar a entender melhor os requisitos de computação e memória dos modelos do Triton Inference Server.

    526+0Variação de estrelas nos últimos 7 dias
  • nanoowl@NVIDIA-AI-IOT

    A project that optimizes OWL-ViT for real-time inference with NVIDIA TensorRT.

    515+8Variação de estrelas nos últimos 7 dias
  • blindai@mithril-security

    Confidential AI deployment with secure enclaves :lock:

    512+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos