distributed-training
标记 distributed-training 主题、收录中的开源项目,按星标数排序。
相关主题
常跟 distributed-training 一起出现在同一个项目上的主题。
近期新秀
近 90 天内创建、标记 distributed-training 主题的项目。
近 90 天内还没有新项目标记这个主题。
- #1
学习如何开发、部署并迭代生产级 ML 应用
★ 49,323+55近 7 天星标变化 - #2
最大规模的 PyTorch 图像编码器/骨干集合,包含训练、评估、推理、导出脚本与预训练权重——ResNet、ResNeXT、EfficientNet、NFNet、Vision Transformer (ViT)、MobileNetV4、MobileNet-V3 & V2、RegNet、DPN、CSPNet、Swin Transformer、MaxViT、CoAtNet、ConvNeXt 等
★ 37,119+11近 7 天星标变化 - #3
Parallel Distributed Deep Learning:来自工业实践的机器学习框架(『飞桨』核心框架,深度学习&机器学习高性能单机、分布式训练和跨平台部署)
★ 24,066+4近 7 天星标变化 - #4★ 12,967-3近 7 天星标变化
- #5★ 10,550+16近 7 天星标变化
- #6★ 10,254+4近 7 天星标变化
- #7★ 5,813+5近 7 天星标变化
- #8
Fengshenbang-LM(封神榜大模型)是 IDEA 研究院认知计算与自然语言研究中心主导的大模型开源体系,成为中文 AIGC 与认知智能的基础设施。
★ 4,122-1近 7 天星标变化 - #9
FEDML - 用于大规模分布式训练、模型部署与联邦学习的统一且具扩展性的机器学习库。跨云调度器 FEDML Launch 进一步支持在任何 GPU 云或本地集群上运行任何 AI 任务。基于此库构建的 TensorOpera AI (https://TensorOpera.ai) 是您的大规模生成式 AI 平台。
★ 4,062+1近 7 天星标变化 - #10
Determined 是一个开源机器学习平台,简化分布式训练、超参数调优、实验跟踪和资源管理。支持 PyTorch 和 TensorFlow。
★ 3,239+2近 7 天星标变化 - #11★ 2,515-1近 7 天星标变化
- #12★ 1,682+2近 7 天星标变化
- #13★ 1,449+2近 7 天星标变化
- #14★ 1,197+0近 7 天星标变化
- #15
高效深度学习系统课程教材
★ 1,031+2近 7 天星标变化 - #16★ 669-1近 7 天星标变化
- #17
关于如何编写分布式 PyTorch 训练代码的最佳实践与指南
★ 630+1近 7 天星标变化 - #18★ 592+11近 7 天星标变化