inference
Repositorios de código abierto monitorizados etiquetados con inference, ordenados por estrellas.
- #31
Superduper: marco de trabajo integral para construir aplicaciones y agentes de IA personalizados.
★ 5318+1Variación de estrellas de los últimos 7 días - #32
cube studio开源云原生一站式机器学习/深度学习/大模型AI平台,mlops算法链路全流程,算力租赁平台,notebook在线开发,拖拉拽任务流pipeline编排,多机多卡分布式训练,超参搜索,推理服务VGPU虚拟化,边缘计算,标注平台自动化标注,deepseek等大模型sft微调/奖励模型/强化学习训练,vllm/ollama/mindie大模型多机推理,私有知识库,AI模型市场,支持国产cpu/gpu/npu 昇腾生态,支持RDMA,支持pytorch/tf/mxnet/deepspeed/paddle/colossalai/horovod/ray/volcano等分布式
★ 5078+3Variación de estrellas de los últimos 7 días - #33★ 4882+3Variación de estrellas de los últimos 7 días
- #34
Motor de inferencia rápido para modelos Transformer
★ 4658+7Variación de estrellas de los últimos 7 días - #35
TNN: desarrollado por Tencent Youtu Lab y Guangying Lab, un framework de inferencia de aprendizaje profundo uniforme para móviles, escritorio y servidores. TNN se destaca por varias características sobresalientes, incluyendo su capacidad multiplataforma, alto rendimiento, compresión de modelos y poda de código. Basado en ncnn y Rapidnet, TNN refuerza aún más el soporte y la optimización de rendimiento para dispositivos móviles, y también
★ 4649+1Variación de estrellas de los últimos 7 días - #36★ 4438+8Variación de estrellas de los últimos 7 días
- #37
Modelos de Deep Learning preentrenados y demos (alta calidad y extremadamente rápidos)
★ 4424+0Variación de estrellas de los últimos 7 días - #38
Logra un rendimiento de inferencia de última generación con aceleradores modernos en Kubernetes
★ 4390+69Variación de estrellas de los últimos 7 días - #39
Un framework unificado de inferencia y post-entrenamiento para la generación acelerada de video.
★ 4300+150Variación de estrellas de los últimos 7 días - #40
CSGHub es una nueva plataforma de código abierto para gestionar LLMs, desarrollada por el equipo de OpenCSG. Ofrece soluciones tanto de código abierto como locales/SaaS, con características comparables a Hugging Face. Obtenga el control total sobre el ciclo de vida de los LLMs, conjuntos de datos y agentes, con compatibilidad de SDK de Python con Hugging Face. ¡Únase a nosotros! ⭐️
★ 4104+3Variación de estrellas de los últimos 7 días - #41
Cualquier modelo. Cualquier hardware. Sin concesiones. Construido con @ziglang / @openxla / MLIR / @bazelbuild
★ 4015+5Variación de estrellas de los últimos 7 días - #42
Toolkit de inferencia y despliegue de alto rendimiento para LLMs y VLMs basado en PaddlePaddle
★ 3714+3Variación de estrellas de los últimos 7 días - #43
El motor de IA local más rápido para Apple Silicon. 4.2x más rápido que Ollama, 0.08s de TTFT en caché, 100% de llamadas a herramientas. 17 analizadores de herramientas, caché de prompts, separación de razonamiento, enrutamiento en la nube. Reemplazo directo para OpenAI. Funciona con Claude Code, Cursor, Aider.
★ 3647+81Variación de estrellas de los últimos 7 días - #44
¡Excelente proyecto para reclutamiento universitario, de otoño, de primavera y pasantías! Te guía para implementar desde cero una biblioteca de inferencia de aprendizaje profundo de alto rendimiento, compatible con la inferencia de modelos grandes como llama2, Unet, Yolov5, Resnet, etc.
★ 3499+2Variación de estrellas de los últimos 7 días - #45
🚀 Acelera la inferencia y el entrenamiento de 🤗 Transformers, Diffusers, TIMM y Sentence Transformers con herramientas de optimización de hardware fáciles de usar
★ 3477+4Variación de estrellas de los últimos 7 días - #46
📚 Tutoriales de Jupyter notebook para OpenVINO™
★ 3212+3Variación de estrellas de los últimos 7 días - #47
Servidor de inferencia de código abierto y clúster de producción para todos los modelos que tu agente necesita.
★ 3030+173Variación de estrellas de los últimos 7 días - #48★ 2961+2Variación de estrellas de los últimos 7 días
- #49
Plugin de hardware mantenido por la comunidad para vLLM en Ascend
★ 2749+19Variación de estrellas de los últimos 7 días - #50
Utiliza Hugging Face con JavaScript
★ 2510+3Variación de estrellas de los últimos 7 días - #51★ 2484+6Variación de estrellas de los últimos 7 días
- #52
Plataforma nativa de la nube de código abierto para ML/DL, MaaS y MLOps. Ofrece un ciclo de vida completo de algoritmos, multi-tenancy, orquestación de flujos de trabajo, entrenamiento distribuido, ajuste fino de modelos (SFT/RLHF), inferencia con vLLM/Ollama, bases de conocimiento privadas y soporte para hardware heterogéneo (Ascend, Cambricon, etc.) con capacidades de computación en el borde.
★ 2469+12Variación de estrellas de los últimos 7 días - #53
Operadores de inferencia de redes neuronales de punto flotante de alta eficiencia para móviles, servidores y Web.
★ 2439+2Variación de estrellas de los últimos 7 días - #54
Convierte cualquier ordenador o dispositivo edge en un centro de control para tus proyectos de visión por computador.
★ 2431+2Variación de estrellas de los últimos 7 días - #55
Domina la IA aplicada, un concepto a la vez
★ 2378+1Variación de estrellas de los últimos 7 días - #56
Orquestación independiente del proveedor para cargas de trabajo de entrenamiento, inferencia y agentes en NVIDIA, AMD, TPU y Tenstorrent en la nube, Kubernetes y bare metal.
★ 2233+4Variación de estrellas de los últimos 7 días - #57★ 2177+5Variación de estrellas de los últimos 7 días
- #58
Inferencia de Llama 2 en un solo archivo de puro 🔥
★ 2126+0Variación de estrellas de los últimos 7 días - #59
MII permite una inferencia de baja latencia y alto rendimiento, impulsada por DeepSpeed.
★ 2112+1Variación de estrellas de los últimos 7 días - #60★ 2076+0Variación de estrellas de los últimos 7 días