Pular para o conteúdo principal
buildradar
Sign in
Tópico · inference

inference

Repositórios de código aberto acompanhados marcados com inference, ordenados por estrelas.

120 repositórios
  • superduper@superduper-io

    Superduper: Framework de ponta a ponta para construir aplicações e agentes de IA personalizados.

    5.318+1Variação de estrelas nos últimos 7 dias
  • cube-studio@tencentmusic

    cube studio开源云原生一站式机器学习/深度学习/大模型AI平台,mlops算法链路全流程,算力租赁平台,notebook在线开发,拖拉拽任务流pipeline编排,多机多卡分布式训练,超参搜索,推理服务VGPU虚拟化,边缘计算,标注平台自动化标注,deepseek等大模型sft微调/奖励模型/强化学习训练,vllm/ollama/mindie大模型多机推理,私有知识库,AI模型市场,支持国产cpu/gpu/npu 昇腾生态,支持RDMA,支持pytorch/tf/mxnet/deepspeed/paddle/colossalai/horovod/ray/volcano等分布式

    5.078+3Variação de estrelas nos últimos 7 dias
  • torch2trt@NVIDIA-AI-IOT

    Um conversor fácil de usar de PyTorch para TensorRT

    4.882+3Variação de estrelas nos últimos 7 dias
  • CTranslate2@OpenNMT

    Motor de inferência rápida para modelos Transformer.

    4.658+7Variação de estrelas nos últimos 7 dias
  • TNN@Tencent

    TNN: desenvolvido pelo Tencent Youtu Lab e Guangying Lab, um framework unificado de inferência de deep learning para celular, desktop e servidor. O TNN se destaca por vários recursos excelentes, incluindo capacidade multiplataforma, alto desempenho, compressão de modelo e poda de código. Com base no ncnn e Rapidnet, o TNN fortalece ainda mais o suporte e a otimização de desempenho para dispositivos móveis.

    4.649+1Variação de estrelas nos últimos 7 dias
  • typedb@typedb

    TypeDB: Criado para sistemas, não para registros

    4.438+8Variação de estrelas nos últimos 7 dias
  • open_model_zoo@openvinotoolkit

    Modelos de Deep Learning pré-treinados e demos (alta qualidade e extremamente rápidos).

    4.424+0Variação de estrelas nos últimos 7 dias
  • llm-d@llm-d

    Alcance um desempenho de inferência de última geração com aceleradores modernos no Kubernetes

    4.390+69Variação de estrelas nos últimos 7 dias
  • FastVideo@hao-ai-lab

    Uma estrutura unificada de inferência e pós-treinamento para geração de vídeo acelerada.

    4.300+150Variação de estrelas nos últimos 7 dias
  • csghub@OpenCSGs

    CSGHub é uma nova plataforma de código aberto para gerenciar LLMs, desenvolvida pela equipe OpenCSG. Oferece soluções de código aberto e on-premise/SaaS, com recursos comparáveis ao Hugging Face. Obtenha controle total sobre o ciclo de vida de LLMs, datasets e agentes, com compatibilidade de SDK Python com o Hugging Face. Junte-se a nós! ⭐️

    4.104+3Variação de estrelas nos últimos 7 dias
  • zml@zml

    Qualquer modelo. Qualquer hardware. Sem compromissos. Construído com @ziglang / @openxla / MLIR / @bazelbuild

    4.015+5Variação de estrelas nos últimos 7 dias
  • FastDeploy@PaddlePaddle

    Kit de ferramentas de inferência e implantação de alto desempenho para LLMs e VLMs baseado em PaddlePaddle.

    3.714+3Variação de estrelas nos últimos 7 dias
  • Rapid-MLX@raullenchai

    O mecanismo de IA local mais rápido para Apple Silicon. 4,2x mais rápido que o Ollama, TTFT em cache de 0,08s, suporte total a chamadas de ferramentas (100% tool calling). 17 analisadores de ferramentas, cache de prompts, separação de raciocínio, roteamento em nuvem. Substituto direto da API OpenAI. Funciona com Claude Code, Cursor e Aider.

    3.647+81Variação de estrelas nos últimos 7 dias
  • KuiperInfer@zjhellofss

    Excelente projeto para processos seletivos e estágios! Guia passo a passo para implementar uma biblioteca de inferência de deep learning de alto desempenho do zero, com suporte a modelos como llama2, Unet, Yolov5, Resnet e outros.

    3.499+2Variação de estrelas nos últimos 7 dias
  • optimum@huggingface

    🚀 Acelere a inferência e o treinamento de 🤗 Transformers, Diffusers, TIMM e Sentence Transformers com ferramentas de otimização de hardware fáceis de usar

    3.477+4Variação de estrelas nos últimos 7 dias
  • openvino_notebooks@openvinotoolkit

    Tutoriais em Jupyter Notebook para OpenVINO™.

    3.212+3Variação de estrelas nos últimos 7 dias
  • sie@superlinked

    Servidor de inferência open-source e cluster de produção para todos os modelos que seu agente precisa.

    3.030+173Variação de estrelas nos últimos 7 dias
  • ao@pytorch

    Quantização nativa em PyTorch para treinamento e inferência.

    2.961+2Variação de estrelas nos últimos 7 dias
  • vllm-ascend@vllm-project

    Plugin de hardware mantido pela comunidade para vLLM em Ascend.

    2.749+19Variação de estrelas nos últimos 7 dias
  • huggingface.js@huggingface

    Use o Hugging Face com JavaScript.

    2.510+3Variação de estrelas nos últimos 7 dias
  • ort@pykeio

    Inferência e treinamento de ML rápidos para modelos ONNX em Rust.

    2.484+6Variação de estrelas nos últimos 7 dias
  • cube-studio@data-infra

    Plataforma de IA de código aberto cubestudio: solução completa nativa em nuvem para aprendizado de máquina, aprendizado profundo e grandes modelos (LLMs). Inclui MaaS, MLOps, orquestração de pipeline, treinamento distribuído, busca de hiperparâmetros, inferência, virtualização VGPU, computação de borda, rotulagem automatizada, ajuste fino (SFT) de modelos como deepseek, suporte a inferência multi-máquina (vllm/ollama/mindie), bases de conhecimento privadas, marketplace de modelos e suporte a hardware heterogêneo (Ascend, Cambricon, etc.) com suporte a RDMA/RoCE.

    2.469+12Variação de estrelas nos últimos 7 dias
  • XNNPACK@google

    Operadores de inferência de rede neural de ponto flutuante de alta eficiência para dispositivos móveis, servidores e Web

    2.439+2Variação de estrelas nos últimos 7 dias
  • inference@roboflow

    Transforme qualquer computador ou dispositivo de borda em uma central de comando para seus projetos de visão computacional.

    2.431+2Variação de estrelas nos últimos 7 dias
  • AI-Engineering.academy@adithya-s-k

    Dominando IA aplicada, um conceito de cada vez.

    2.378+1Variação de estrelas nos últimos 7 dias
  • dstack@dstackai

    Orquestração agnóstica de fornecedor para cargas de trabalho de treinamento, inferência e agentes em NVIDIA, AMD, TPU e Tenstorrent em nuvens, Kubernetes e bare metal.

    2.233+4Variação de estrelas nos últimos 7 dias
  • any-llm@mozilla-ai

    Comunique-se com um provedor de LLM usando uma interface única

    2.177+5Variação de estrelas nos últimos 7 dias
  • llama2.mojo@tairov

    Inferência do Llama 2 em um único arquivo de puro 🔥

    2.126+0Variação de estrelas nos últimos 7 dias
  • DeepSpeed-MII@deepspeedai

    O MII possibilita inferência de baixa latência e alto rendimento, impulsionado pelo DeepSpeed.

    2.112+1Variação de estrelas nos últimos 7 dias
  • aici@microsoft

    AICI: Prompts como Programas (Wasm)

    2.076+0Variação de estrelas nos últimos 7 dias
← Voltar para os tópicos