inference
Repositórios de código aberto acompanhados marcados com inference, ordenados por estrelas.
- #91
Tutorial da API C++ do TensorRT
★ 811+0Variação de estrelas nos últimos 7 dias - #92★ 803+0Variação de estrelas nos últimos 7 dias
- #93★ 783—Variação de estrelas nos últimos 7 dias
- #94
Pacote Python pequeno, rápido e sem dependências para inferir tipos de arquivos binários verificando a assinatura dos números mágicos
★ 773+3Variação de estrelas nos últimos 7 dias - #95
Notebooks de exemplo para trabalhar com o SageMaker Studio Lab. Inscreva-se para uma conta no link abaixo!
★ 772+1Variação de estrelas nos últimos 7 dias - #96
Ferramenta de produtividade de IA - Gratuita e de código aberto, melhora a produtividade do usuário e protege a privacidade e a segurança dos dados. Incluindo, mas não limitado a: modelos locais integrados como ChatGPT, DeepSeek, Phi, Qwen e outros, processamento inteligente em lote com um clique de imagens, vídeos, áudio, etc.
★ 768-1Variação de estrelas nos últimos 7 dias - #97
⚡ Servidor de inferência LLM nativo em MLX Swift para Apple Silicon. API compatível com OpenAI, streaming SSD para modelos MoE 100B+, compressão de cache KV TurboQuant, aplicativo para macOS e iOS iPhone.
★ 760+8Variação de estrelas nos últimos 7 dias - #98★ 753+0Variação de estrelas nos últimos 7 dias
- #99
Mecanismo de inferência de Machine Learning para microcontroladores e dispositivos embarcados
★ 753+5Variação de estrelas nos últimos 7 dias - #100★ 748+3Variação de estrelas nos últimos 7 dias
- #101
O yolort é uma pilha de execução para o yolov5 em aceleradores especializados, como tensorrt, libtorch, onnxruntime, tvm e ncnn.
★ 730+0Variação de estrelas nos últimos 7 dias - #102
Privacy Meter: Uma biblioteca de código aberto para auditar a privacidade de dados em algoritmos estatísticos e de machine learning.
★ 725+1Variação de estrelas nos últimos 7 dias - #103
Graph Data Science: uma camada de abstração em Python para construir grafos de conhecimento, integrada com bibliotecas de grafos populares – sobre Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow, etc.
★ 691+2Variação de estrelas nos últimos 7 dias - #104
Ollama para modelos de ML clássicos. Compilador AOT que transforma modelos XGBoost, LightGBM, scikit-learn, CatBoost e ONNX em código de inferência C99 nativo. Um comando para carregar, um comando para servir. 336x mais rápido que a inferência em Python.
★ 687+0Variação de estrelas nos últimos 7 dias - #105
Treine um detector de objetos yolov3 de última geração do zero!
★ 677+0Variação de estrelas nos últimos 7 dias - #106
Mecanismo de inferência de LLM em Pure Rust + CUDA — sem PyTorch, compatível com OpenAI, serve de Qwen3 a Kimi-K2
★ 676+17Variação de estrelas nos últimos 7 dias - #107★ 673+5Variação de estrelas nos últimos 7 dias
- #108
Um mecanismo de inferência onnx em puro C99, leve e portátil, para dispositivos embarcados com suporte a aceleração de hardware.
★ 652+0Variação de estrelas nos últimos 7 dias - #109
Orquestração de tarefas de GPU serverless de alto desempenho — a camada de agendamento por trás de wavespeed.ai
★ 632+0Variação de estrelas nos últimos 7 dias - #110
Implemente a inferência do llama3 passo a passo, compreenda os conceitos centrais, domine a derivação do processo e escreva o código.
★ 630+0Variação de estrelas nos últimos 7 dias - #111
O Deep Learning Streamer (DL Streamer) Pipeline Framework é um framework de análise de mídia de streaming de código aberto, baseado no framework multimídia GStreamer*, para criar pipelines complexos de análise de mídia para a nuvem ou na borda (Edge).
★ 622-1Variação de estrelas nos últimos 7 dias - #112
converta o modelo mmdetection para tensorrt, com suporte a fp16, int8, entrada em lote, formato dinâmico, etc.
★ 596+0Variação de estrelas nos últimos 7 dias - #113★ 561—Variação de estrelas nos últimos 7 dias
- #114
Biblioteca Python para detecção de pequenos objetos e segmentação de instâncias com YOLO
★ 557+0Variação de estrelas nos últimos 7 dias - #115
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 548—Variação de estrelas nos últimos 7 dias - #116★ 539+2Variação de estrelas nos últimos 7 dias
- #117
Execute suas cargas de trabalho de deep learning no Kubernetes com mais facilidade e eficiência.
★ 532+1Variação de estrelas nos últimos 7 dias - #118
Triton Model Analyzer é uma ferramenta de linha de comando para ajudar a entender melhor os requisitos de computação e memória dos modelos do Triton Inference Server.
★ 526+0Variação de estrelas nos últimos 7 dias - #119
A project that optimizes OWL-ViT for real-time inference with NVIDIA TensorRT.
★ 515+8Variação de estrelas nos últimos 7 dias - #120★ 512+0Variação de estrelas nos últimos 7 dias