Saltar al contenido principal
buildradar
Sign in
Tema · inference

inference

Repositorios de código abierto monitorizados etiquetados con inference, ordenados por estrellas.

Repositorios
117
Estrellas totales
769.346
Estrellas de media
6576
Proporción
0,04%

Temas que aparecen con frecuencia junto a inference en un mismo repositorio.

Emergentes recientes

Repositorios creados en los últimos 90 días, etiquetados con inference.

  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    10.387
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    513
  • vllm@vllm-project

    Un motor de inferencia y servicio de alto rendimiento y eficiente en memoria para LLMs

    90.415+745Variación de estrellas de los últimos 7 días
  • yolov5@ultralytics

    Ultralytics YOLOv5 en PyTorch para detección de objetos, segmentación de instancias, clasificación, entrenamiento y exportación.

    57.939+20Variación de estrellas de los últimos 7 días
  • whisper.cpp@ggml-org

    Puerto del modelo Whisper de OpenAI en C/C++

    53.286+193Variación de estrellas de los últimos 7 días
  • DeepSpeed@deepspeedai

    DeepSpeed es una biblioteca de optimización de aprendizaje profundo que hace que el entrenamiento y la inferencia distribuidos sean fáciles, eficientes y efectivos.

    43.019+44Variación de estrellas de los últimos 7 días
  • ColossalAI@hpcaitech

    Hacer que los modelos de IA grandes sean más económicos, rápidos y accesibles

    41.446+8Variación de estrellas de los últimos 7 días
  • mediapipe@google-ai-edge

    Soluciones de ML multiplataforma y personalizables para contenido multimedia en vivo y en streaming.

    36.769+83Variación de estrellas de los últimos 7 días
  • sglang@sgl-project

    SGLang es un marco de servicio de alto rendimiento para modelos de lenguaje grande y modelos multimodales.

    32.747+503Variación de estrellas de los últimos 7 días
  • faster-whisper@SYSTRAN

    Transcripción de Whisper más rápida con CTranslate2

    25.135+108Variación de estrellas de los últimos 7 días
  • ncnn@Tencent

    ncnn es un marco de inferencia de redes neuronales de alto rendimiento optimizado para plataformas móviles

    23.763+34Variación de estrellas de los últimos 7 días
  • ml-engineering@stas00

    Libro abierto de ingeniería de aprendizaje automático

    18.835+152Variación de estrellas de los últimos 7 días
  • nano-vllm@GeeeekExplorer

    Nano vLLM

    15.218+137Variación de estrellas de los últimos 7 días
  • ts-pattern@gvergnaud

    🎨 La biblioteca exhaustiva de coincidencia de patrones (Pattern Matching) para TypeScript, con inferencia de tipos inteligente.

    15.141+10Variación de estrellas de los últimos 7 días
  • TensorRT@NVIDIA

    NVIDIA® TensorRT™ es un SDK para la inferencia de aprendizaje profundo de alto rendimiento en GPU de NVIDIA. Este repositorio contiene los componentes de código abierto de TensorRT.

    13.305+32Variación de estrellas de los últimos 7 días
  • LMCache@LMCache

    LMCache: Potencia tu LLM con la capa de caché KV más rápida

    11.562+256Variación de estrellas de los últimos 7 días
  • amazon-sagemaker-examples@aws

    Cuadernos Jupyter de ejemplo 📓 que demuestran cómo construir, entrenar y desplegar modelos de machine learning usando 🧠 Amazon SageMaker.

    10.981+2Variación de estrellas de los últimos 7 días
  • server@triton-inference-server

    Triton Inference Server ofrece una solución optimizada de inferencia para la nube y el extremo (edge).

    10.949+18Variación de estrellas de los últimos 7 días
  • openvino@openvinotoolkit

    OpenVINO™ es un kit de herramientas de código abierto para optimizar y desplegar inferencia de IA

    10.763+72Variación de estrellas de los últimos 7 días
  • yolov3@ultralytics

    Implementación en PyTorch de YOLOv3, YOLOv3-SPP y YOLOv3-tiny para detección de objetos en tiempo real con entrenamiento, validación, inferencia y exportación multiformato.

    10.599+4Variación de estrellas de los últimos 7 días
  • FreeToken@FlashML-org

    FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.

    10.387Variación de estrellas de los últimos 7 días
  • runanywhere-sdks@RunanywhereAI

    Herramientas listas para producción para ejecutar IA de forma local.

    10.280-12Variación de estrellas de los últimos 7 días
  • inference@xorbitsai

    Intercambia GPT por cualquier LLM cambiando una sola línea de código. Xinference te permite ejecutar modelos de código abierto, de voz y multimodales en la nube, localmente o en tu laptop, todo a través de una API de inferencia unificada y lista para producción.

    9528+21Variación de estrellas de los últimos 7 días
  • oumi@oumi-ai

    ¡Ajusta, evalúa y despliega fácilmente Qwen, Gemma o cualquier LLM de pesos abiertos!

    9380+3Variación de estrellas de los últimos 7 días
  • Guía Hello AI World para implementar redes de inferencia de deep-learning y primitivas de visión profunda con TensorRT y NVIDIA Jetson.

    8974+6Variación de estrellas de los últimos 7 días
  • io-ts@gcanti

    Sistema de tipos en tiempo de ejecución para decodificación/codificación de IO

    6809+1Variación de estrellas de los últimos 7 días
  • vllm-omni@vllm-project

    Un framework para la inferencia eficiente de modelos omnimodales.

    6457+229Variación de estrellas de los últimos 7 días
  • Mooncake@kvcache-ai

    Mooncake es la plataforma de servicio para Kimi, un servicio de LLM líder proporcionado por Moonshot AI.

    6430+90Variación de estrellas de los últimos 7 días
  • argmax-oss-swift@argmaxinc

    IA de voz en el dispositivo para Apple Silicon.

    6345+11Variación de estrellas de los últimos 7 días
  • Adversarial Robustness Toolbox (ART) - Biblioteca de Python para la seguridad en Machine Learning - Evasión, Envenenamiento, Extracción, Inferencia - Equipos Rojos y Azules

    6210+20Variación de estrellas de los últimos 7 días
  • gpustack@gpustack

    Un administrador de clústeres de GPU para el servicio de modelos de IA de alto rendimiento (vLLM, SGLang) e instancias de GPU accesibles por SSH bajo demanda.

    5572+37Variación de estrellas de los últimos 7 días
  • semantic-router@vllm-project

    Un enrutador programable de mezcla de modelos (Mixture-of-Models) para inferencia de LLM heterogénea

    5405+190Variación de estrellas de los últimos 7 días
← Volver a temas