inference
Repositorios de código abierto monitorizados etiquetados con inference, ordenados por estrellas.
- #91
Tutorial de la API de C++ para TensorRT.
★ 811+1Variación de estrellas de los últimos 7 días - #92★ 802+0Variación de estrellas de los últimos 7 días
- #93
Paquete de Python pequeño, rápido y sin dependencias para inferir tipos de archivos binarios mediante la verificación de la firma de números mágicos
★ 772+1Variación de estrellas de los últimos 7 días - #94
Notebooks de ejemplo para trabajar con SageMaker Studio Lab. ¡Regístrate para obtener una cuenta en el enlace de abajo!
★ 771+0Variación de estrellas de los últimos 7 días - #95
Herramienta de productividad con IA: gratuita y de código abierto, diseñada para mejorar la productividad del usuario y proteger la privacidad y la seguridad de los datos. Incluye, entre otros: modelos locales exclusivos integrados como ChatGPT, DeepSeek, Phi, Qwen y otros, además de procesamiento inteligente por lotes con un solo clic para imágenes, videos, audio, etc.
★ 769+0Variación de estrellas de los últimos 7 días - #96
Servidor de inferencia LLM nativo en MLX Swift para Apple Silicon. API compatible con OpenAI, streaming SSD para modelos MoE de más de 100B, compresión de caché KV TurboQuant, aplicación para MACOS + iOS iPhone.
★ 758+5Variación de estrellas de los últimos 7 días - #97★ 753+0Variación de estrellas de los últimos 7 días
- #98
Motor de inferencia de aprendizaje automático para microcontroladores y dispositivos embebidos.
★ 752+1Variación de estrellas de los últimos 7 días - #99★ 747+3Variación de estrellas de los últimos 7 días
- #100
yolort es una pila de ejecución para yolov5 en aceleradores especializados como TensorRT, libtorch, onnxruntime, tvm y ncnn.
★ 730+0Variación de estrellas de los últimos 7 días - #101
Privacy Meter: una biblioteca de código abierto para auditar la privacidad de los datos en algoritmos de estadística y aprendizaje automático.
★ 724+0Variación de estrellas de los últimos 7 días - #102
Graph Data Science: una capa de abstracción en Python para construir grafos de conocimiento, integrada con bibliotecas de grafos populares como Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow, entre otras.
★ 691+2Variación de estrellas de los últimos 7 días - #103
Ollama para modelos de ML clásico. Compilador AOT que convierte modelos de XGBoost, LightGBM, scikit-learn, CatBoost y ONNX en código de inferencia C99 nativo. Un comando para cargar, un comando para servir. 336 veces más rápido que la inferencia en Python.
★ 687-1Variación de estrellas de los últimos 7 días - #104
¡Entrena un detector de objetos yolov3 de última generación desde cero!
★ 677+0Variación de estrellas de los últimos 7 días - #105
Motor de inferencia LLM en Rust puro + CUDA; sin PyTorch, compatible con OpenAI, sirve desde Qwen3 hasta Kimi-K2
★ 673+13Variación de estrellas de los últimos 7 días - #106★ 672+5Variación de estrellas de los últimos 7 días
- #107
Motor de inferencia ONNX ligero, portátil y en C99 puro para dispositivos integrados con soporte de aceleración por hardware.
★ 652-1Variación de estrellas de los últimos 7 días - #108
Orquestación de tareas GPU sin servidor de alto rendimiento: la capa de programación detrás de wavespeed.ai
★ 632+0Variación de estrellas de los últimos 7 días - #109
Realice la inferencia de llama3 paso a paso, comprenda los conceptos básicos, domine la derivación del proceso e implemente el código.
★ 630+0Variación de estrellas de los últimos 7 días - #110
Deep Learning Streamer (DL Streamer) Pipeline Framework es un marco de análisis de medios de transmisión de código abierto, basado en GStreamer, para crear pipelines complejos de análisis de medios para la nube o el borde
★ 623+0Variación de estrellas de los últimos 7 días - #111
Convierte modelos de mmdetection a TensorRT, compatible con fp16, int8, entrada por lotes, forma dinámica, etc.
★ 596+0Variación de estrellas de los últimos 7 días - #112★ 561—Variación de estrellas de los últimos 7 días
- #113
Biblioteca de Python para detección de objetos pequeños y segmentación de instancias con YOLO
★ 557+0Variación de estrellas de los últimos 7 días - #114
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 542—Variación de estrellas de los últimos 7 días - #115★ 538+0Variación de estrellas de los últimos 7 días
- #116
Ejecute sus cargas de trabajo de aprendizaje profundo en Kubernetes de forma más fácil y eficiente.
★ 532+1Variación de estrellas de los últimos 7 días - #117
Triton Model Analyzer es una herramienta de línea de comandos para ayudar a comprender mejor los requisitos de cómputo y memoria de los modelos de Triton Inference Server.
★ 526+0Variación de estrellas de los últimos 7 días - #118★ 524—Variación de estrellas de los últimos 7 días
- #119
A project that optimizes OWL-ViT for real-time inference with NVIDIA TensorRT.
★ 513—Variación de estrellas de los últimos 7 días - #120★ 512+0Variación de estrellas de los últimos 7 días