model-serving
model-serving 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 model-serving 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 model-serving 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1★ 90,415+745최근 7일 스타 변화
- #2★ 8,813+18최근 7일 스타 변화
- #3★ 6,457+229최근 7일 스타 변화
- #4★ 5,840+25최근 7일 스타 변화
- #5★ 5,243+10최근 7일 스타 변화
- #6
이 저장소에서는 딥러닝 기반 모델을 프로덕션에 배포하는 것과 관련된 유용한 노트와 참고 자료를 공유합니다.
★ 4,376+1최근 7일 스타 변화 - #7
🚀 멋진 머신러닝 시스템 ⚡️ AI 시스템 논문 및 업계 프랙티스. ⚡️ 머신러닝 시스템, LLM (대형 언어 모델), GenAI (생성형 AI). 🍻 OSDI, NSDI, SIGCOMM, SoCC, MLSys 등. 🗃️ Llama3, Mistral 등. 🧑💻 동영상 튜토리얼.
★ 4,318+27최근 7일 스타 변화 - #8★ 4,251+21최근 7일 스타 변화
- #9
대규모 분산 학습, 모델 서빙, 연합 학습을 위한 통합 및 확장 가능한 ML 라이브러리인 FEDML. 크로스 클라우드 스케줄러인 FEDML Launch를 통해 모든 GPU 클라우드나 온프레미스 클러스터에서 AI 작업을 실행할 수 있습니다. 이 라이브러리를 기반으로 구축된 TensorOpera AI(https://TensorOpera.ai)는 대규모 생성형 AI 플랫폼입니다.
★ 4,061-1최근 7일 스타 변화 - #10★ 3,826-2최근 7일 스타 변화
- #11★ 2,998+5최근 7일 스타 변화
- #12
Ascend 기반 vLLM을 위한 커뮤니티 유지보수 하드웨어 플러그인
★ 2,730+53최근 7일 스타 변화 - #13★ 2,346+9최근 7일 스타 변화
- #14★ 2,227+3최근 7일 스타 변화
- #15★ 2,076+0최근 7일 스타 변화
- #16
MLRun은 전체 라이프사이클에 걸쳐 지속적인 ML 애플리케이션을 빠르게 구축하고 관리하기 위한 오픈소스 MLOps 플랫폼입니다. 개발 및 CI/CD 환경에 통합되어 프로덕션 데이터, ML 파이프라인, 온라인 애플리케이션의 배포를 자동화합니다.
★ 1,694+0최근 7일 스타 변화 - #17★ 1,409+5최근 7일 스타 변화
- #18★ 1,320+6최근 7일 스타 변화
- #19★ 1,303+1최근 7일 스타 변화
- #20★ 1,196+1최근 7일 스타 변화
- #21
SGLang-Omni는 TTS, ASR, 음성 및 옴니 모델을 위한 고성능 서빙을 지원합니다.
★ 978+70최근 7일 스타 변화 - #22★ 974+0최근 7일 스타 변화
- #23
OpenVINO™로 최적화된 모델을 위한 확장 가능한 추론 서버
★ 921+3최근 7일 스타 변화 - #24★ 908+0최근 7일 스타 변화
- #25★ 902+0최근 7일 스타 변화
- #26
모두를 위한 Serverless LLM 서빙.
★ 711+6최근 7일 스타 변화 - #27
전통적인 ML 모델을 위한 Ollama입니다. XGBoost, LightGBM, scikit-learn, CatBoost 및 ONNX 모델을 네이티브 C99 추론 코드로 변환하는 AOT 컴파일러로, Python 추론 대비 336배 빠릅니다.
★ 687-1최근 7일 스타 변화 - #28
Pure Rust + CUDA LLM 추론 엔진 — PyTorch 미사용, OpenAI 호환, Qwen3에서 Kimi-K2까지 서비스 제공
★ 660+4최근 7일 스타 변화 - #29
머신러닝 모델을 프로덕션 환경에서 서비스하기 위한 FastAPI 스켈레톤 앱
★ 603-1최근 7일 스타 변화 - #30
Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton
★ 502—최근 7일 스타 변화