inference
Repositorios de código abierto monitorizados etiquetados con inference, ordenados por estrellas.
Temas relacionados
Temas que aparecen con frecuencia junto a inference en un mismo repositorio.
Emergentes recientes
Repositorios creados en los últimos 90 días, etiquetados con inference.
- #1
FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.
★ 10.387 - #2
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 513
- #1
Un motor de inferencia y servicio de alto rendimiento y eficiente en memoria para LLMs
★ 90.415+745Variación de estrellas de los últimos 7 días - #2
Ultralytics YOLOv5 en PyTorch para detección de objetos, segmentación de instancias, clasificación, entrenamiento y exportación.
★ 57.939+20Variación de estrellas de los últimos 7 días - #3
Puerto del modelo Whisper de OpenAI en C/C++
★ 53.286+193Variación de estrellas de los últimos 7 días - #4
DeepSpeed es una biblioteca de optimización de aprendizaje profundo que hace que el entrenamiento y la inferencia distribuidos sean fáciles, eficientes y efectivos.
★ 43.019+44Variación de estrellas de los últimos 7 días - #5
Hacer que los modelos de IA grandes sean más económicos, rápidos y accesibles
★ 41.446+8Variación de estrellas de los últimos 7 días - #6
Soluciones de ML multiplataforma y personalizables para contenido multimedia en vivo y en streaming.
★ 36.769+83Variación de estrellas de los últimos 7 días - #7
SGLang es un marco de servicio de alto rendimiento para modelos de lenguaje grande y modelos multimodales.
★ 32.747+503Variación de estrellas de los últimos 7 días - #8
Transcripción de Whisper más rápida con CTranslate2
★ 25.135+108Variación de estrellas de los últimos 7 días - #9
ncnn es un marco de inferencia de redes neuronales de alto rendimiento optimizado para plataformas móviles
★ 23.763+34Variación de estrellas de los últimos 7 días - #10
Libro abierto de ingeniería de aprendizaje automático
★ 18.835+152Variación de estrellas de los últimos 7 días - #11★ 15.218+137Variación de estrellas de los últimos 7 días
- #12
🎨 La biblioteca exhaustiva de coincidencia de patrones (Pattern Matching) para TypeScript, con inferencia de tipos inteligente.
★ 15.141+10Variación de estrellas de los últimos 7 días - #13
NVIDIA® TensorRT™ es un SDK para la inferencia de aprendizaje profundo de alto rendimiento en GPU de NVIDIA. Este repositorio contiene los componentes de código abierto de TensorRT.
★ 13.305+32Variación de estrellas de los últimos 7 días - #14★ 11.562+256Variación de estrellas de los últimos 7 días
- #15
Cuadernos Jupyter de ejemplo 📓 que demuestran cómo construir, entrenar y desplegar modelos de machine learning usando 🧠 Amazon SageMaker.
★ 10.981+2Variación de estrellas de los últimos 7 días - #16
Triton Inference Server ofrece una solución optimizada de inferencia para la nube y el extremo (edge).
★ 10.949+18Variación de estrellas de los últimos 7 días - #17
OpenVINO™ es un kit de herramientas de código abierto para optimizar y desplegar inferencia de IA
★ 10.763+72Variación de estrellas de los últimos 7 días - #18
Implementación en PyTorch de YOLOv3, YOLOv3-SPP y YOLOv3-tiny para detección de objetos en tiempo real con entrenamiento, validación, inferencia y exportación multiformato.
★ 10.599+4Variación de estrellas de los últimos 7 días - #19
FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.
★ 10.387—Variación de estrellas de los últimos 7 días - #20
Herramientas listas para producción para ejecutar IA de forma local.
★ 10.280-12Variación de estrellas de los últimos 7 días - #21
Intercambia GPT por cualquier LLM cambiando una sola línea de código. Xinference te permite ejecutar modelos de código abierto, de voz y multimodales en la nube, localmente o en tu laptop, todo a través de una API de inferencia unificada y lista para producción.
★ 9528+21Variación de estrellas de los últimos 7 días - #22★ 9380+3Variación de estrellas de los últimos 7 días
- #23
Guía Hello AI World para implementar redes de inferencia de deep-learning y primitivas de visión profunda con TensorRT y NVIDIA Jetson.
★ 8974+6Variación de estrellas de los últimos 7 días - #24★ 6809+1Variación de estrellas de los últimos 7 días
- #25★ 6457+229Variación de estrellas de los últimos 7 días
- #26
Mooncake es la plataforma de servicio para Kimi, un servicio de LLM líder proporcionado por Moonshot AI.
★ 6430+90Variación de estrellas de los últimos 7 días - #27
IA de voz en el dispositivo para Apple Silicon.
★ 6345+11Variación de estrellas de los últimos 7 días - #28
Adversarial Robustness Toolbox (ART) - Biblioteca de Python para la seguridad en Machine Learning - Evasión, Envenenamiento, Extracción, Inferencia - Equipos Rojos y Azules
★ 6210+20Variación de estrellas de los últimos 7 días - #29
Un administrador de clústeres de GPU para el servicio de modelos de IA de alto rendimiento (vLLM, SGLang) e instancias de GPU accesibles por SSH bajo demanda.
★ 5572+37Variación de estrellas de los últimos 7 días - #30
Un enrutador programable de mezcla de modelos (Mixture-of-Models) para inferencia de LLM heterogénea
★ 5405+190Variación de estrellas de los últimos 7 días