Saltar al contenido principal
buildradar
Sign in
Tema · inference

inference

Repositorios de código abierto monitorizados etiquetados con inference, ordenados por estrellas.

120 repositorios
  • ai-gateway@envoyproxy

    Gestiona el acceso unificado a servicios de IA generativa construidos sobre Envoy Gateway

    1990+16Variación de estrellas de los últimos 7 días
  • picolm@RightNow-AI

    Ejecuta un LLM de 1 mil millones de parámetros en una placa de 10 dólares con 256 MB de RAM

    1927+4Variación de estrellas de los últimos 7 días
  • agibot_x1_infer@AgibotTech

    El módulo de inferencia para AgiBot X1.

    1835+1Variación de estrellas de los últimos 7 días
  • NNPACK@Maratyszcza

    Paquete de aceleración para redes neuronales en CPUs multicorte

    1711+1Variación de estrellas de los últimos 7 días
  • Servidor de inferencia de CPU/GPU eficiente, escalable y de nivel empresarial para modelos transformer de 🤗 Hugging Face.

    1690+0Variación de estrellas de los últimos 7 días
  • uzu@trymirai

    Un motor de inferencia de alto rendimiento para modelos de IA

    1687+4Variación de estrellas de los últimos 7 días
  • InferenceX@SemiAnalysisAI

    Plataforma de investigación de benchmarks de inferencia continua de código abierto — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 y próximamente™ TPUv6e/v7/Trainium2/3

    1613+33Variación de estrellas de los últimos 7 días
  • llmgateway@theopenco

    Enruta, gestiona y analiza tus solicitudes de LLM a través de múltiples proveedores con una interfaz de API unificada

    1594+8Variación de estrellas de los últimos 7 días
  • xllm@xLLM-AI

    Un motor de inferencia de alto rendimiento para modelos LLM, VLM, DiT y REC, optimizado para diversos aceleradores de IA. Está alojado en la OpenAtom Foundation.

    1552+11Variación de estrellas de los últimos 7 días
  • Un entorno de ejecución rápido y fácil de usar para la inferencia de transformers (Bert, Albert, GPT2, Decoders, etc.) en CPU y GPU.

    1550+1Variación de estrellas de los últimos 7 días
  • Exportador de GPU Nvidia para Prometheus usando el binario nvidia-smi o NVML

    1550+4Variación de estrellas de los últimos 7 días
  • budgetml@ebhy

    Despliega un servicio de inferencia de ML con bajo presupuesto en menos de 10 líneas de código.

    1343+0Variación de estrellas de los últimos 7 días
  • rtp-llm@alibaba

    RTP-LLM: motor de inferencia de LLM de alto rendimiento de Alibaba para diversas aplicaciones.

    1325+6Variación de estrellas de los últimos 7 días
  • EmbedAnything@StarlightSearch

    Inferencia, ingesta e indexación de alto rendimiento, modulares, seguras para la memoria y listas para producción, construidas en Rust 🦀

    1305-1Variación de estrellas de los últimos 7 días
  • CausalDiscoveryToolbox@FenTechSolutions

    Paquete para inferencia causal en grafos y configuraciones por pares. Se incluyen herramientas para la recuperación de la estructura de grafos y dependencias.

    1237+0Variación de estrellas de los últimos 7 días
  • kubetorch@run-house

    Distribuye y ejecuta cargas de trabajo de IA en Kubernetes de forma mágica con Python, similar a PyTorch para infraestructura de ML.

    1224+0Variación de estrellas de los últimos 7 días
  • kvpress@NVIDIA

    Compresión de caché KV para LLM simplificada

    1201+5Variación de estrellas de los últimos 7 días
  • ai-hub-models@qualcomm

    Qualcomm® AI Hub Models es nuestra colección de modelos de aprendizaje automático de última generación optimizados para el rendimiento (latencia, memoria, etc.) y listos para implementar en dispositivos Qualcomm®.

    1195+1Variación de estrellas de los últimos 7 días
  • sglang-omni@sgl-project

    SGLang-Omni permite un servicio de alto rendimiento para modelos de TTS, ASR, voz y modelos omni.

    1118+143Variación de estrellas de los últimos 7 días
  • mlx-serve@ddalcu

    Servidor de inferencia LLM nativo para Apple Silicon. Compatible con la API de OpenAI y Anthropic. Sin Python. Incluye la aplicación MLX Core para macOS con chat, modo agente y llamada a herramientas.

    1115+245Variación de estrellas de los últimos 7 días
  • tiny-vllm@jmaczan

    Construye tu propio motor de inferencia LLM de alto rendimiento en C++ y CUDA: una versión más pequeña de vLLM.

    1094+15Variación de estrellas de los últimos 7 días
  • Nanoflow@efeslab

    Un framework de servicio de alto rendimiento orientado al rendimiento para LLMs.

    975+1Variación de estrellas de los últimos 7 días
  • mlxstudio@jjang-ai

    MLX Studio - Hogar de JANG_Q - Generación/Edición de imágenes + Chat/Código todo en uno - + OpenClaw (API de Anthropic)

    964+6Variación de estrellas de los últimos 7 días
  • bolt@huawei-noah

    Bolt es una biblioteca de aprendizaje profundo con alto rendimiento y flexibilidad heterogénea.

    957+0Variación de estrellas de los últimos 7 días
  • ims@OpenIntroStat

    📚 Introducción a la estadística moderna: un libro de texto de código abierto de nivel universitario con un enfoque moderno que destaca las relaciones multivariables y la inferencia basada en simulación.

    944+1Variación de estrellas de los últimos 7 días
  • neuropod@uber

    Una interfaz uniforme para ejecutar modelos de aprendizaje profundo de múltiples marcos de trabajo.

    943+0Variación de estrellas de los últimos 7 días
  • model_server@openvinotoolkit

    Un servidor de inferencia escalable para modelos optimizados con OpenVINO™.

    927+5Variación de estrellas de los últimos 7 días
  • bark.cpp@PABannier

    Modelo Bark de Suno AI en C/C++ para una generación rápida de texto a voz.

    867+1Variación de estrellas de los últimos 7 días
  • pipeless@pipeless-ai

    Un framework de visión artificial de código abierto para crear y desplegar aplicaciones en minutos.

    851-1Variación de estrellas de los últimos 7 días
  • pytriton@triton-inference-server

    PyTriton es una interfaz similar a Flask/FastAPI que simplifica el despliegue de Triton en entornos Python.

    848+0Variación de estrellas de los últimos 7 días
← Volver a temas