inference
Repositorios de código abierto monitorizados etiquetados con inference, ordenados por estrellas.
- #61
Gestiona el acceso unificado a servicios de IA generativa construidos sobre Envoy Gateway
★ 1990+16Variación de estrellas de los últimos 7 días - #62
Ejecuta un LLM de 1 mil millones de parámetros en una placa de 10 dólares con 256 MB de RAM
★ 1927+4Variación de estrellas de los últimos 7 días - #63
El módulo de inferencia para AgiBot X1.
★ 1835+1Variación de estrellas de los últimos 7 días - #64★ 1711+1Variación de estrellas de los últimos 7 días
- #65
Servidor de inferencia de CPU/GPU eficiente, escalable y de nivel empresarial para modelos transformer de 🤗 Hugging Face.
★ 1690+0Variación de estrellas de los últimos 7 días - #66★ 1687+4Variación de estrellas de los últimos 7 días
- #67
Plataforma de investigación de benchmarks de inferencia continua de código abierto — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 y próximamente™ TPUv6e/v7/Trainium2/3
★ 1613+33Variación de estrellas de los últimos 7 días - #68
Enruta, gestiona y analiza tus solicitudes de LLM a través de múltiples proveedores con una interfaz de API unificada
★ 1594+8Variación de estrellas de los últimos 7 días - #69
Un motor de inferencia de alto rendimiento para modelos LLM, VLM, DiT y REC, optimizado para diversos aceleradores de IA. Está alojado en la OpenAtom Foundation.
★ 1552+11Variación de estrellas de los últimos 7 días - #70
Un entorno de ejecución rápido y fácil de usar para la inferencia de transformers (Bert, Albert, GPT2, Decoders, etc.) en CPU y GPU.
★ 1550+1Variación de estrellas de los últimos 7 días - #71
Exportador de GPU Nvidia para Prometheus usando el binario nvidia-smi o NVML
★ 1550+4Variación de estrellas de los últimos 7 días - #72
Despliega un servicio de inferencia de ML con bajo presupuesto en menos de 10 líneas de código.
★ 1343+0Variación de estrellas de los últimos 7 días - #73
RTP-LLM: motor de inferencia de LLM de alto rendimiento de Alibaba para diversas aplicaciones.
★ 1325+6Variación de estrellas de los últimos 7 días - #74
Inferencia, ingesta e indexación de alto rendimiento, modulares, seguras para la memoria y listas para producción, construidas en Rust 🦀
★ 1305-1Variación de estrellas de los últimos 7 días - #75
Paquete para inferencia causal en grafos y configuraciones por pares. Se incluyen herramientas para la recuperación de la estructura de grafos y dependencias.
★ 1237+0Variación de estrellas de los últimos 7 días - #76
Distribuye y ejecuta cargas de trabajo de IA en Kubernetes de forma mágica con Python, similar a PyTorch para infraestructura de ML.
★ 1224+0Variación de estrellas de los últimos 7 días - #77★ 1201+5Variación de estrellas de los últimos 7 días
- #78
Qualcomm® AI Hub Models es nuestra colección de modelos de aprendizaje automático de última generación optimizados para el rendimiento (latencia, memoria, etc.) y listos para implementar en dispositivos Qualcomm®.
★ 1195+1Variación de estrellas de los últimos 7 días - #79
SGLang-Omni permite un servicio de alto rendimiento para modelos de TTS, ASR, voz y modelos omni.
★ 1118+143Variación de estrellas de los últimos 7 días - #80
Servidor de inferencia LLM nativo para Apple Silicon. Compatible con la API de OpenAI y Anthropic. Sin Python. Incluye la aplicación MLX Core para macOS con chat, modo agente y llamada a herramientas.
★ 1115+245Variación de estrellas de los últimos 7 días - #81
Construye tu propio motor de inferencia LLM de alto rendimiento en C++ y CUDA: una versión más pequeña de vLLM.
★ 1094+15Variación de estrellas de los últimos 7 días - #82★ 975+1Variación de estrellas de los últimos 7 días
- #83
MLX Studio - Hogar de JANG_Q - Generación/Edición de imágenes + Chat/Código todo en uno - + OpenClaw (API de Anthropic)
★ 964+6Variación de estrellas de los últimos 7 días - #84
Bolt es una biblioteca de aprendizaje profundo con alto rendimiento y flexibilidad heterogénea.
★ 957+0Variación de estrellas de los últimos 7 días - #85
📚 Introducción a la estadística moderna: un libro de texto de código abierto de nivel universitario con un enfoque moderno que destaca las relaciones multivariables y la inferencia basada en simulación.
★ 944+1Variación de estrellas de los últimos 7 días - #86
Una interfaz uniforme para ejecutar modelos de aprendizaje profundo de múltiples marcos de trabajo.
★ 943+0Variación de estrellas de los últimos 7 días - #87
Un servidor de inferencia escalable para modelos optimizados con OpenVINO™.
★ 927+5Variación de estrellas de los últimos 7 días - #88★ 867+1Variación de estrellas de los últimos 7 días
- #89
Un framework de visión artificial de código abierto para crear y desplegar aplicaciones en minutos.
★ 851-1Variación de estrellas de los últimos 7 días - #90
PyTriton es una interfaz similar a Flask/FastAPI que simplifica el despliegue de Triton en entornos Python.
★ 848+0Variación de estrellas de los últimos 7 días