Saltar al contenido principal
buildradar
Sign in
Tema · inference

inference

Repositorios de código abierto monitorizados etiquetados con inference, ordenados por estrellas.

120 repositorios
  • superduper@superduper-io

    Superduper: marco de trabajo integral para construir aplicaciones y agentes de IA personalizados.

    5318+1Variación de estrellas de los últimos 7 días
  • cube-studio@tencentmusic

    cube studio开源云原生一站式机器学习/深度学习/大模型AI平台,mlops算法链路全流程,算力租赁平台,notebook在线开发,拖拉拽任务流pipeline编排,多机多卡分布式训练,超参搜索,推理服务VGPU虚拟化,边缘计算,标注平台自动化标注,deepseek等大模型sft微调/奖励模型/强化学习训练,vllm/ollama/mindie大模型多机推理,私有知识库,AI模型市场,支持国产cpu/gpu/npu 昇腾生态,支持RDMA,支持pytorch/tf/mxnet/deepspeed/paddle/colossalai/horovod/ray/volcano等分布式

    5078+3Variación de estrellas de los últimos 7 días
  • torch2trt@NVIDIA-AI-IOT

    Un conversor de PyTorch a TensorRT fácil de usar

    4882+3Variación de estrellas de los últimos 7 días
  • CTranslate2@OpenNMT

    Motor de inferencia rápido para modelos Transformer

    4658+7Variación de estrellas de los últimos 7 días
  • TNN@Tencent

    TNN: desarrollado por Tencent Youtu Lab y Guangying Lab, un framework de inferencia de aprendizaje profundo uniforme para móviles, escritorio y servidores. TNN se destaca por varias características sobresalientes, incluyendo su capacidad multiplataforma, alto rendimiento, compresión de modelos y poda de código. Basado en ncnn y Rapidnet, TNN refuerza aún más el soporte y la optimización de rendimiento para dispositivos móviles, y también

    4649+1Variación de estrellas de los últimos 7 días
  • typedb@typedb

    TypeDB: Construido para sistemas, no para registros

    4438+8Variación de estrellas de los últimos 7 días
  • open_model_zoo@openvinotoolkit

    Modelos de Deep Learning preentrenados y demos (alta calidad y extremadamente rápidos)

    4424+0Variación de estrellas de los últimos 7 días
  • llm-d@llm-d

    Logra un rendimiento de inferencia de última generación con aceleradores modernos en Kubernetes

    4390+69Variación de estrellas de los últimos 7 días
  • FastVideo@hao-ai-lab

    Un framework unificado de inferencia y post-entrenamiento para la generación acelerada de video.

    4300+150Variación de estrellas de los últimos 7 días
  • csghub@OpenCSGs

    CSGHub es una nueva plataforma de código abierto para gestionar LLMs, desarrollada por el equipo de OpenCSG. Ofrece soluciones tanto de código abierto como locales/SaaS, con características comparables a Hugging Face. Obtenga el control total sobre el ciclo de vida de los LLMs, conjuntos de datos y agentes, con compatibilidad de SDK de Python con Hugging Face. ¡Únase a nosotros! ⭐️

    4104+3Variación de estrellas de los últimos 7 días
  • zml@zml

    Cualquier modelo. Cualquier hardware. Sin concesiones. Construido con @ziglang / @openxla / MLIR / @bazelbuild

    4015+5Variación de estrellas de los últimos 7 días
  • FastDeploy@PaddlePaddle

    Toolkit de inferencia y despliegue de alto rendimiento para LLMs y VLMs basado en PaddlePaddle

    3714+3Variación de estrellas de los últimos 7 días
  • Rapid-MLX@raullenchai

    El motor de IA local más rápido para Apple Silicon. 4.2x más rápido que Ollama, 0.08s de TTFT en caché, 100% de llamadas a herramientas. 17 analizadores de herramientas, caché de prompts, separación de razonamiento, enrutamiento en la nube. Reemplazo directo para OpenAI. Funciona con Claude Code, Cursor, Aider.

    3647+81Variación de estrellas de los últimos 7 días
  • KuiperInfer@zjhellofss

    ¡Excelente proyecto para reclutamiento universitario, de otoño, de primavera y pasantías! Te guía para implementar desde cero una biblioteca de inferencia de aprendizaje profundo de alto rendimiento, compatible con la inferencia de modelos grandes como llama2, Unet, Yolov5, Resnet, etc.

    3499+2Variación de estrellas de los últimos 7 días
  • optimum@huggingface

    🚀 Acelera la inferencia y el entrenamiento de 🤗 Transformers, Diffusers, TIMM y Sentence Transformers con herramientas de optimización de hardware fáciles de usar

    3477+4Variación de estrellas de los últimos 7 días
  • openvino_notebooks@openvinotoolkit

    📚 Tutoriales de Jupyter notebook para OpenVINO™

    3212+3Variación de estrellas de los últimos 7 días
  • sie@superlinked

    Servidor de inferencia de código abierto y clúster de producción para todos los modelos que tu agente necesita.

    3030+173Variación de estrellas de los últimos 7 días
  • ao@pytorch

    Cuantización nativa de PyTorch para entrenamiento e inferencia

    2961+2Variación de estrellas de los últimos 7 días
  • vllm-ascend@vllm-project

    Plugin de hardware mantenido por la comunidad para vLLM en Ascend

    2749+19Variación de estrellas de los últimos 7 días
  • huggingface.js@huggingface

    Utiliza Hugging Face con JavaScript

    2510+3Variación de estrellas de los últimos 7 días
  • ort@pykeio

    Inferencia y entrenamiento de ML rápidos para modelos ONNX en Rust

    2484+6Variación de estrellas de los últimos 7 días
  • cube-studio@data-infra

    Plataforma nativa de la nube de código abierto para ML/DL, MaaS y MLOps. Ofrece un ciclo de vida completo de algoritmos, multi-tenancy, orquestación de flujos de trabajo, entrenamiento distribuido, ajuste fino de modelos (SFT/RLHF), inferencia con vLLM/Ollama, bases de conocimiento privadas y soporte para hardware heterogéneo (Ascend, Cambricon, etc.) con capacidades de computación en el borde.

    2469+12Variación de estrellas de los últimos 7 días
  • XNNPACK@google

    Operadores de inferencia de redes neuronales de punto flotante de alta eficiencia para móviles, servidores y Web.

    2439+2Variación de estrellas de los últimos 7 días
  • inference@roboflow

    Convierte cualquier ordenador o dispositivo edge en un centro de control para tus proyectos de visión por computador.

    2431+2Variación de estrellas de los últimos 7 días
  • AI-Engineering.academy@adithya-s-k

    Domina la IA aplicada, un concepto a la vez

    2378+1Variación de estrellas de los últimos 7 días
  • dstack@dstackai

    Orquestación independiente del proveedor para cargas de trabajo de entrenamiento, inferencia y agentes en NVIDIA, AMD, TPU y Tenstorrent en la nube, Kubernetes y bare metal.

    2233+4Variación de estrellas de los últimos 7 días
  • any-llm@mozilla-ai

    Comunícate con un proveedor de LLM utilizando una interfaz única

    2177+5Variación de estrellas de los últimos 7 días
  • llama2.mojo@tairov

    Inferencia de Llama 2 en un solo archivo de puro 🔥

    2126+0Variación de estrellas de los últimos 7 días
  • DeepSpeed-MII@deepspeedai

    MII permite una inferencia de baja latencia y alto rendimiento, impulsada por DeepSpeed.

    2112+1Variación de estrellas de los últimos 7 días
  • aici@microsoft

    AICI: Prompts como programas (Wasm)

    2076+0Variación de estrellas de los últimos 7 días
← Volver a temas