Saltar al contenido principal
buildradar
Sign in
Tema · inference

inference

Repositorios de código abierto monitorizados etiquetados con inference, ordenados por estrellas.

120 repositorios
  • tensorrt-cpp-api@cyrusbehr

    Tutorial de la API de C++ para TensorRT.

    811+1Variación de estrellas de los últimos 7 días
  • cppflow@serizba

    Ejecuta modelos de TensorFlow en C++ sin instalación y sin Bazel

    802+0Variación de estrellas de los últimos 7 días
  • filetype.py@h2non

    Paquete de Python pequeño, rápido y sin dependencias para inferir tipos de archivos binarios mediante la verificación de la firma de números mágicos

    772+1Variación de estrellas de los últimos 7 días
  • studio-lab-examples@aws

    Notebooks de ejemplo para trabajar con SageMaker Studio Lab. ¡Regístrate para obtener una cuenta en el enlace de abajo!

    771+0Variación de estrellas de los últimos 7 días
  • APT@rnchg

    Herramienta de productividad con IA: gratuita y de código abierto, diseñada para mejorar la productividad del usuario y proteger la privacidad y la seguridad de los datos. Incluye, entre otros: modelos locales exclusivos integrados como ChatGPT, DeepSeek, Phi, Qwen y otros, además de procesamiento inteligente por lotes con un solo clic para imágenes, videos, audio, etc.

    769+0Variación de estrellas de los últimos 7 días
  • SwiftLM@SharpAI

    Servidor de inferencia LLM nativo en MLX Swift para Apple Silicon. API compatible con OpenAI, streaming SSD para modelos MoE de más de 100B, compresión de caché KV TurboQuant, aplicación para MACOS + iOS iPhone.

    758+5Variación de estrellas de los últimos 7 días
  • InferLLM@MegEngine

    un framework ligero de inferencia para modelos LLM

    753+0Variación de estrellas de los últimos 7 días
  • emlearn@emlearn

    Motor de inferencia de aprendizaje automático para microcontroladores y dispositivos embebidos.

    752+1Variación de estrellas de los últimos 7 días
  • identYwaf@stamparm

    Herramienta de identificación de WAF a ciegas.

    747+3Variación de estrellas de los últimos 7 días
  • yolort@zhiqwang

    yolort es una pila de ejecución para yolov5 en aceleradores especializados como TensorRT, libtorch, onnxruntime, tvm y ncnn.

    730+0Variación de estrellas de los últimos 7 días
  • ml_privacy_meter@privacytrustlab

    Privacy Meter: una biblioteca de código abierto para auditar la privacidad de los datos en algoritmos de estadística y aprendizaje automático.

    724+0Variación de estrellas de los últimos 7 días
  • kglab@DerwenAI

    Graph Data Science: una capa de abstracción en Python para construir grafos de conocimiento, integrada con bibliotecas de grafos populares como Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow, entre otras.

    691+2Variación de estrellas de los últimos 7 días
  • timber@kossisoroyce

    Ollama para modelos de ML clásico. Compilador AOT que convierte modelos de XGBoost, LightGBM, scikit-learn, CatBoost y ONNX en código de inferencia C99 nativo. Un comando para cargar, un comando para servir. 336 veces más rápido que la inferencia en Python.

    687-1Variación de estrellas de los últimos 7 días
  • TrainYourOwnYOLO@AntonMu

    ¡Entrena un detector de objetos yolov3 de última generación desde cero!

    677+0Variación de estrellas de los últimos 7 días
  • pegainfer@pegainfer-project

    Motor de inferencia LLM en Rust puro + CUDA; sin PyTorch, compatible con OpenAI, sirve desde Qwen3 hasta Kimi-K2

    673+13Variación de estrellas de los últimos 7 días
  • vidur@microsoft

    Simulador preciso, escalable y extensible para sistemas de inferencia de LLM

    672+5Variación de estrellas de los últimos 7 días
  • libonnx@xboot

    Motor de inferencia ONNX ligero, portátil y en C99 puro para dispositivos integrados con soporte de aceleración por hardware.

    652-1Variación de estrellas de los últimos 7 días
  • waverless@WaveSpeedAI

    Orquestación de tareas GPU sin servidor de alto rendimiento: la capa de programación detrás de wavespeed.ai

    632+0Variación de estrellas de los últimos 7 días
  • Deepdive-llama3-from-scratch@therealoliver

    Realice la inferencia de llama3 paso a paso, comprenda los conceptos básicos, domine la derivación del proceso e implemente el código.

    630+0Variación de estrellas de los últimos 7 días
  • dlstreamer@open-edge-platform

    Deep Learning Streamer (DL Streamer) Pipeline Framework es un marco de análisis de medios de transmisión de código abierto, basado en GStreamer, para crear pipelines complejos de análisis de medios para la nube o el borde

    623+0Variación de estrellas de los últimos 7 días
  • Convierte modelos de mmdetection a TensorRT, compatible con fp16, int8, entrada por lotes, forma dinámica, etc.

    596+0Variación de estrellas de los últimos 7 días
  • inferoa@agentic-in

    Inference-native Tokenmaxxing Agent Harness for Loop Engineering

    561Variación de estrellas de los últimos 7 días
  • Biblioteca de Python para detección de objetos pequeños y segmentación de instancias con YOLO

    557+0Variación de estrellas de los últimos 7 días
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    542Variación de estrellas de los últimos 7 días
  • aikit@kaito-project

    🏗️ ¡Ajusta, construye y despliega LLMs de código abierto fácilmente!

    538+0Variación de estrellas de los últimos 7 días
  • kubedl@kubedl-io

    Ejecute sus cargas de trabajo de aprendizaje profundo en Kubernetes de forma más fácil y eficiente.

    532+1Variación de estrellas de los últimos 7 días
  • model_analyzer@triton-inference-server

    Triton Model Analyzer es una herramienta de línea de comandos para ayudar a comprender mejor los requisitos de cómputo y memoria de los modelos de Triton Inference Server.

    526+0Variación de estrellas de los últimos 7 días
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    524Variación de estrellas de los últimos 7 días
  • nanoowl@NVIDIA-AI-IOT

    A project that optimizes OWL-ViT for real-time inference with NVIDIA TensorRT.

    513Variación de estrellas de los últimos 7 días
  • blindai@mithril-security

    Despliegue de IA confidencial con enclaves seguros

    512+0Variación de estrellas de los últimos 7 días
← Volver a temas