inference
Repositórios de código aberto acompanhados marcados com inference, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de inference no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com inference.
- #1
FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.
★ 10.552 - #2
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 513
- #1
Um mecanismo de inferência e atendimento de alto rendimento e eficiente em memória para LLMs
★ 90.415+745Variação de estrelas nos últimos 7 dias - #2
Ultralytics YOLOv5 em PyTorch para detecção de objetos, segmentação de instâncias, classificação, treinamento e exportação.
★ 57.939+20Variação de estrelas nos últimos 7 dias - #3
Port do modelo Whisper da OpenAI em C/C++
★ 53.286+193Variação de estrelas nos últimos 7 dias - #4
O DeepSpeed é uma biblioteca de otimização de deep learning que torna o treinamento e a inferência distribuídos fáceis, eficientes e eficazes.
★ 43.019+44Variação de estrelas nos últimos 7 dias - #5
Tornando grandes modelos de IA mais baratos, rápidos e acessíveis
★ 41.446+8Variação de estrelas nos últimos 7 dias - #6
Soluções de ML multiplataforma e personalizáveis para mídia ao vivo e em streaming.
★ 36.769+83Variação de estrelas nos últimos 7 dias - #7
SGLang é um framework de atendimento de alto desempenho para grandes modelos de linguagem e modelos multimodais.
★ 32.747+503Variação de estrelas nos últimos 7 dias - #8
Transcrição Whisper mais rápida com CTranslate2
★ 25.135+108Variação de estrelas nos últimos 7 dias - #9
ncnn é um framework de inferência de redes neurais de alto desempenho otimizado para plataformas móveis
★ 23.763+34Variação de estrelas nos últimos 7 dias - #10
Livro aberto de engenharia de aprendizado de máquina.
★ 18.835+152Variação de estrelas nos últimos 7 dias - #11★ 15.218+137Variação de estrelas nos últimos 7 dias
- #12
A biblioteca exaustiva de Pattern Matching para TypeScript, com inferência de tipos inteligente.
★ 15.141+10Variação de estrelas nos últimos 7 dias - #13
NVIDIA® TensorRT™ é um SDK para inferência de deep learning de alto desempenho em GPUs NVIDIA. Este repositório contém os componentes de código aberto do TensorRT.
★ 13.305+32Variação de estrelas nos últimos 7 dias - #14★ 11.562+256Variação de estrelas nos últimos 7 dias
- #15
Exemplos de notebooks Jupyter que demonstram como construir, treinar e implantar modelos de aprendizado de máquina usando o Amazon SageMaker.
★ 10.981+2Variação de estrelas nos últimos 7 dias - #16
O Triton Inference Server fornece uma solução otimizada de inferência em nuvem e na borda.
★ 10.949+18Variação de estrelas nos últimos 7 dias - #17
OpenVINO™ é um kit de ferramentas de código aberto para otimizar e implantar inferência de IA
★ 10.763+72Variação de estrelas nos últimos 7 dias - #18
Implementação em PyTorch do YOLOv3, YOLOv3-SPP e YOLOv3-tiny para detecção de objetos em tempo real, com treinamento, validação, inferência e exportação em múltiplos formatos.
★ 10.599+4Variação de estrelas nos últimos 7 dias - #19
FreeToken brings datacenter-scale model serving to your desktop. Run massive models locally, fast and efficiently.
★ 10.552—Variação de estrelas nos últimos 7 dias - #20
Kit de ferramentas pronto para produção para executar IA localmente.
★ 10.280-12Variação de estrelas nos últimos 7 dias - #21
Troque o GPT por qualquer LLM alterando apenas uma linha de código. O Xinference permite executar modelos de código aberto, de fala e multimodais na nuvem, localmente ou no seu laptop — tudo através de uma API de inferência unificada e pronta para produção.
★ 9.528+21Variação de estrelas nos últimos 7 dias - #22
Faça o ajuste fino, avalie e implante facilmente Qwen, Gemma ou qualquer LLM de pesos abertos!
★ 9.380+3Variação de estrelas nos últimos 7 dias - #23
Guia Hello AI World para implantar redes de inferência de deep learning e primitivas de visão computacional com TensorRT e NVIDIA Jetson.
★ 8.974+6Variação de estrelas nos últimos 7 dias - #24★ 6.809+1Variação de estrelas nos últimos 7 dias
- #25
Um framework para inferência eficiente de modelos com modelos de omnimodalidade
★ 6.457+229Variação de estrelas nos últimos 7 dias - #26
Mooncake é a plataforma de serviço para o Kimi, um serviço de LLM líder fornecido pela Moonshot AI.
★ 6.430+90Variação de estrelas nos últimos 7 dias - #27
IA de fala executada localmente no dispositivo para Apple Silicon
★ 6.345+11Variação de estrelas nos últimos 7 dias - #28
Adversarial Robustness Toolbox (ART) - Biblioteca Python para segurança em Machine Learning - Evasão, Envenenamento, Extração, Inferência - Red e Blue Teams
★ 6.210+20Variação de estrelas nos últimos 7 dias - #29
Um gerenciador de cluster de GPU para servir modelos de IA de alto desempenho (vLLM, SGLang) e instâncias de GPU acessíveis via SSH sob demanda.
★ 5.572+37Variação de estrelas nos últimos 7 dias - #30
Um roteador programável de Mistura de Modelos (Mixture-of-Models) para inferência heterogênea de LLM
★ 5.405+190Variação de estrelas nos últimos 7 dias