inference
Repositórios de código aberto acompanhados marcados com inference, ordenados por estrelas.
- #31
Superduper: Framework de ponta a ponta para construir aplicações e agentes de IA personalizados.
★ 5.318+1Variação de estrelas nos últimos 7 dias - #32
cube studio开源云原生一站式机器学习/深度学习/大模型AI平台,mlops算法链路全流程,算力租赁平台,notebook在线开发,拖拉拽任务流pipeline编排,多机多卡分布式训练,超参搜索,推理服务VGPU虚拟化,边缘计算,标注平台自动化标注,deepseek等大模型sft微调/奖励模型/强化学习训练,vllm/ollama/mindie大模型多机推理,私有知识库,AI模型市场,支持国产cpu/gpu/npu 昇腾生态,支持RDMA,支持pytorch/tf/mxnet/deepspeed/paddle/colossalai/horovod/ray/volcano等分布式
★ 5.078+3Variação de estrelas nos últimos 7 dias - #33★ 4.882+3Variação de estrelas nos últimos 7 dias
- #34
Motor de inferência rápida para modelos Transformer.
★ 4.658+7Variação de estrelas nos últimos 7 dias - #35
TNN: desenvolvido pelo Tencent Youtu Lab e Guangying Lab, um framework unificado de inferência de deep learning para celular, desktop e servidor. O TNN se destaca por vários recursos excelentes, incluindo capacidade multiplataforma, alto desempenho, compressão de modelo e poda de código. Com base no ncnn e Rapidnet, o TNN fortalece ainda mais o suporte e a otimização de desempenho para dispositivos móveis.
★ 4.649+1Variação de estrelas nos últimos 7 dias - #36★ 4.438+8Variação de estrelas nos últimos 7 dias
- #37
Modelos de Deep Learning pré-treinados e demos (alta qualidade e extremamente rápidos).
★ 4.424+0Variação de estrelas nos últimos 7 dias - #38
Alcance um desempenho de inferência de última geração com aceleradores modernos no Kubernetes
★ 4.390+69Variação de estrelas nos últimos 7 dias - #39
Uma estrutura unificada de inferência e pós-treinamento para geração de vídeo acelerada.
★ 4.300+150Variação de estrelas nos últimos 7 dias - #40
CSGHub é uma nova plataforma de código aberto para gerenciar LLMs, desenvolvida pela equipe OpenCSG. Oferece soluções de código aberto e on-premise/SaaS, com recursos comparáveis ao Hugging Face. Obtenha controle total sobre o ciclo de vida de LLMs, datasets e agentes, com compatibilidade de SDK Python com o Hugging Face. Junte-se a nós! ⭐️
★ 4.104+3Variação de estrelas nos últimos 7 dias - #41
Qualquer modelo. Qualquer hardware. Sem compromissos. Construído com @ziglang / @openxla / MLIR / @bazelbuild
★ 4.015+5Variação de estrelas nos últimos 7 dias - #42
Kit de ferramentas de inferência e implantação de alto desempenho para LLMs e VLMs baseado em PaddlePaddle.
★ 3.714+3Variação de estrelas nos últimos 7 dias - #43
O mecanismo de IA local mais rápido para Apple Silicon. 4,2x mais rápido que o Ollama, TTFT em cache de 0,08s, suporte total a chamadas de ferramentas (100% tool calling). 17 analisadores de ferramentas, cache de prompts, separação de raciocínio, roteamento em nuvem. Substituto direto da API OpenAI. Funciona com Claude Code, Cursor e Aider.
★ 3.647+81Variação de estrelas nos últimos 7 dias - #44
Excelente projeto para processos seletivos e estágios! Guia passo a passo para implementar uma biblioteca de inferência de deep learning de alto desempenho do zero, com suporte a modelos como llama2, Unet, Yolov5, Resnet e outros.
★ 3.499+2Variação de estrelas nos últimos 7 dias - #45
🚀 Acelere a inferência e o treinamento de 🤗 Transformers, Diffusers, TIMM e Sentence Transformers com ferramentas de otimização de hardware fáceis de usar
★ 3.477+4Variação de estrelas nos últimos 7 dias - #46
Tutoriais em Jupyter Notebook para OpenVINO™.
★ 3.212+3Variação de estrelas nos últimos 7 dias - #47
Servidor de inferência open-source e cluster de produção para todos os modelos que seu agente precisa.
★ 3.030+173Variação de estrelas nos últimos 7 dias - #48★ 2.961+2Variação de estrelas nos últimos 7 dias
- #49
Plugin de hardware mantido pela comunidade para vLLM em Ascend.
★ 2.749+19Variação de estrelas nos últimos 7 dias - #50
Use o Hugging Face com JavaScript.
★ 2.510+3Variação de estrelas nos últimos 7 dias - #51★ 2.484+6Variação de estrelas nos últimos 7 dias
- #52
Plataforma de IA de código aberto cubestudio: solução completa nativa em nuvem para aprendizado de máquina, aprendizado profundo e grandes modelos (LLMs). Inclui MaaS, MLOps, orquestração de pipeline, treinamento distribuído, busca de hiperparâmetros, inferência, virtualização VGPU, computação de borda, rotulagem automatizada, ajuste fino (SFT) de modelos como deepseek, suporte a inferência multi-máquina (vllm/ollama/mindie), bases de conhecimento privadas, marketplace de modelos e suporte a hardware heterogêneo (Ascend, Cambricon, etc.) com suporte a RDMA/RoCE.
★ 2.469+12Variação de estrelas nos últimos 7 dias - #53
Operadores de inferência de rede neural de ponto flutuante de alta eficiência para dispositivos móveis, servidores e Web
★ 2.439+2Variação de estrelas nos últimos 7 dias - #54
Transforme qualquer computador ou dispositivo de borda em uma central de comando para seus projetos de visão computacional.
★ 2.431+2Variação de estrelas nos últimos 7 dias - #55
Dominando IA aplicada, um conceito de cada vez.
★ 2.378+1Variação de estrelas nos últimos 7 dias - #56
Orquestração agnóstica de fornecedor para cargas de trabalho de treinamento, inferência e agentes em NVIDIA, AMD, TPU e Tenstorrent em nuvens, Kubernetes e bare metal.
★ 2.233+4Variação de estrelas nos últimos 7 dias - #57★ 2.177+5Variação de estrelas nos últimos 7 dias
- #58
Inferência do Llama 2 em um único arquivo de puro 🔥
★ 2.126+0Variação de estrelas nos últimos 7 dias - #59
O MII possibilita inferência de baixa latência e alto rendimento, impulsionado pelo DeepSpeed.
★ 2.112+1Variação de estrelas nos últimos 7 dias - #60★ 2.076+0Variação de estrelas nos últimos 7 dias