distributed-training
Repositórios de código aberto acompanhados marcados com distributed-training, ordenados por estrelas.
Tópicos relacionados
Tópicos que aparecem com frequência ao lado de distributed-training no mesmo repositório.
Em ascensão recentemente
Repositórios criados nos últimos 90 dias e marcados com distributed-training.
Nenhum repositório novo marcado com este tópico nos últimos 90 dias.
- #1
Aprenda a desenvolver, implantar e iterar em aplicações de ML de nível de produção.
★ 49.323+89Variação de estrelas nos últimos 7 dias - #2
A maior coleção de codificadores de imagem / backbones para PyTorch. Inclui scripts de treino, avaliação, inferência, exportação e pesos pré-treinados -- ResNet, ResNeXT, EfficientNet, NFNet, Vision Transformer (ViT), MobileNetV4, MobileNet-V3 & V2, RegNet, DPN, CSPNet, Swin Transformer, MaxViT, CoAtNet, ConvNeXt e muito mais
★ 37.119+19Variação de estrelas nos últimos 7 dias - #3
PArallel Distributed Deep LEarning: Framework de aprendizado de máquina baseado em práticas industriais (Framework principal do PaddlePaddle, para treinamento distribuído/local de alto desempenho e implantação multiplataforma).
★ 24.066+4Variação de estrelas nos últimos 7 dias - #4
Biblioteca de LLM e SLM poderosa e fácil de usar, com um excelente conjunto de modelos.
★ 12.967+0Variação de estrelas nos últimos 7 dias - #5
A plataforma de computação de IA para equipes de fronteira. O SkyPilot transforma computação de IA fragmentada em um supercomputador de IA, permitindo que equipes de IA de fronteira construam inteligência personalizada mais rapidamente.
★ 10.550+22Variação de estrelas nos últimos 7 dias - #6★ 10.254+9Variação de estrelas nos últimos 7 dias
- #7★ 5.813+9Variação de estrelas nos últimos 7 dias
- #8
Fengshenbang-LM é um sistema de modelos de linguagem de grande escala de código aberto liderado pelo Centro de Pesquisa em Computação Cognitiva e Processamento de Linguagem Natural do IDEA, servindo como infraestrutura para AIGC e inteligência cognitiva em chinês.
★ 4.122-1Variação de estrelas nos últimos 7 dias - #9
FEDML - A biblioteca de ML unificada e escalável para treinamento distribuído em larga escala, serviço de modelos e aprendizado federado. O FEDML Launch, um agendador cross-cloud, permite executar qualquer trabalho de IA em qualquer nuvem de GPU ou cluster local. Construída sobre esta biblioteca, a TensorOpera AI (https://TensorOpera.ai) é sua plataforma de IA generativa em escala.
★ 4.062+0Variação de estrelas nos últimos 7 dias - #10
Determined é uma plataforma de aprendizado de máquina de código aberto que simplifica o treinamento distribuído, o ajuste de hiperparâmetros, o rastreamento de experimentos e o gerenciamento de recursos. Funciona com PyTorch e TensorFlow.
★ 3.239+3Variação de estrelas nos últimos 7 dias - #11
Deep learning descentralizado em PyTorch. Criado para treinar modelos em milhares de voluntários ao redor do mundo.
★ 2.515+0Variação de estrelas nos últimos 7 dias - #12
DLRover: Um sistema de aprendizado profundo distribuído automático
★ 1.682+2Variação de estrelas nos últimos 7 dias - #13
Biblioteca de comunicações coletivas com várias primitivas para treinamento em múltiplas máquinas.
★ 1.449+2Variação de estrelas nos últimos 7 dias - #14
DeepRec é um framework de deep learning para recomendação de alto desempenho baseado em TensorFlow. Está hospedado em incubação na LF AI & Data Foundation.
★ 1.197+0Variação de estrelas nos últimos 7 dias - #15
Materiais do curso de Sistemas de Deep Learning Eficientes
★ 1.031+2Variação de estrelas nos últimos 7 dias - #16
🌾 OAT: Uma estrutura amigável para pesquisa de alinhamento online de LLMs, incluindo aprendizado por reforço, aprendizado por preferência, etc.
★ 669-1Variação de estrelas nos últimos 7 dias - #17
Melhores práticas e guias sobre como escrever código de treinamento distribuído em PyTorch
★ 630+0Variação de estrelas nos últimos 7 dias - #18
Um Motor de Aprendizado por Reforço Assíncrono para Pós-Treinamento Omni-Modal em Escala
★ 590+7Variação de estrelas nos últimos 7 dias