본문으로 건너뛰기
buildradar
Sign in
토픽 · model-serving

model-serving

model-serving 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리
30
총 스타
164,226
평균 스타
5,474
비중
0.01%

같은 리포지토리에 model-serving 태그와 자주 함께 쓰이는 토픽이에요.

최근 라이징

최근 90일 안에 만들어지고 model-serving 태그가 달린 리포지토리예요.

최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.

  • vllm@vllm-project

    LLM을 위한 고성능 및 메모리 효율적인 추론 및 서빙 엔진

    90,415+745최근 7일 스타 변화
  • BentoML@bentoml

    AI 앱과 모델을 서빙하는 가장 쉬운 방법 - 모델 추론 API, 작업 큐, LLM 앱, 멀티 모델 파이프라인 등을 구축하세요!

    8,813+18최근 7일 스타 변화
  • vllm-omni@vllm-project

    옴니 모달리티 모델을 위한 효율적인 모델 추론 프레임워크

    6,457+229최근 7일 스타 변화
  • kserve@kserve

    Kubernetes에서의 확장 가능한 멀티 프레임워크 배포를 위한 표준화된 분산 생성형 및 예측형 AI 추론 플랫폼

    5,840+25최근 7일 스타 변화
  • Olares@beclab

    상시 작동 에이전트를 위한 오픈소스 퍼스널 클라우드 OS

    5,243+10최근 7일 스타 변화
  • 이 저장소에서는 딥러닝 기반 모델을 프로덕션에 배포하는 것과 관련된 유용한 노트와 참고 자료를 공유합니다.

    4,376+1최근 7일 스타 변화
  • 🚀 멋진 머신러닝 시스템 ⚡️ AI 시스템 논문 및 업계 프랙티스. ⚡️ 머신러닝 시스템, LLM (대형 언어 모델), GenAI (생성형 AI). 🍻 OSDI, NSDI, SIGCOMM, SoCC, MLSys 등. 🗃️ Llama3, Mistral 등. 🧑‍💻 동영상 튜토리얼.

    4,318+27최근 7일 스타 변화
  • LightLLM@ModelTC

    LightLLM은 가벼운 디자인, 쉬운 확장성, 고속 성능이 특징인 파이썬 기반 LLM(대규모 언어 모델) 추론 및 서빙 프레임워크입니다.

    4,251+21최근 7일 스타 변화
  • FedML@FedML-AI

    대규모 분산 학습, 모델 서빙, 연합 학습을 위한 통합 및 확장 가능한 ML 라이브러리인 FEDML. 크로스 클라우드 스케줄러인 FEDML Launch를 통해 모든 GPU 클라우드나 온프레미스 클러스터에서 AI 작업을 실행할 수 있습니다. 이 라이브러리를 기반으로 구축된 TensorOpera AI(https://TensorOpera.ai)는 대규모 생성형 AI 플랫폼입니다.

    4,061-1최근 7일 스타 변화
  • lorax@predibase

    수천 개의 파인튜닝된 LLM으로 확장 가능한 멀티 LoRA 추론 서버

    3,826-2최근 7일 스타 변화
  • chitu@thu-pacman

    효율성, 유연성, 가용성에 중점을 둔 대규모 언어 모델용 고성능 추론 프레임워크입니다.

    2,998+5최근 7일 스타 변화
  • vllm-ascend@vllm-project

    Ascend 기반 vLLM을 위한 커뮤니티 유지보수 하드웨어 플러그인

    2,730+53최근 7일 스타 변화
  • openlake@openlake-project

    OpenLake는 효율적인 LLM 추론과 GPU 학습을 위한 고성능 스토리지 엔진입니다

    2,346+9최근 7일 스타 변화
  • envd@tensorchord

    인간과 에이전트를 위한 재현 가능한 개발 환경

    2,227+3최근 7일 스타 변화
  • aici@microsoft

    AICI: (Wasm) 프로그램으로서의 프롬프트

    2,076+0최근 7일 스타 변화
  • mlrun@mlrun

    MLRun은 전체 라이프사이클에 걸쳐 지속적인 ML 애플리케이션을 빠르게 구축하고 관리하기 위한 오픈소스 MLOps 플랫폼입니다. 개발 및 CI/CD 환경에 통합되어 프로덕션 데이터, ML 파이프라인, 온라인 애플리케이션의 배포를 자동화합니다.

    1,694+0최근 7일 스타 변화
  • kitops@kitops-ml

    AI/ML 모델, 데이터셋, 코드, 설정을 OCI 아티팩트로 패키징하고 버전 관리하기 위한 CNCF의 오픈 소스 DevOps 도구입니다.

    1,409+5최근 7일 스타 변화
  • rtp-llm@alibaba

    RTP-LLM: 다양한 애플리케이션을 위한 Alibaba의 고성능 LLM 추론 엔진.

    1,320+6최근 7일 스타 변화
  • hopsworks@logicalclocks

    Hopsworks - 피처 스토어가 포함된 데이터 집약적 AI 플랫폼

    1,303+1최근 7일 스타 변화
  • truss@basetenlabs

    AI/ML 모델을 프로덕션 환경에서 서비스하는 가장 간단한 방법

    1,196+1최근 7일 스타 변화
  • sglang-omni@sgl-project

    SGLang-Omni는 TTS, ASR, 음성 및 옴니 모델을 위한 고성능 서빙을 지원합니다.

    978+70최근 7일 스타 변화
  • Nanoflow@efeslab

    LLM을 위한 처리량 중심의 고성능 서빙 프레임워크

    974+0최근 7일 스타 변화
  • model_server@openvinotoolkit

    OpenVINO™로 최적화된 모델을 위한 확장 가능한 추론 서버

    921+3최근 7일 스타 변화
  • ZhiLight@zhihu

    Llama 및 그 변형 모델을 위한 고도로 최적화된 LLM 추론 가속 엔진입니다.

    908+0최근 7일 스타 변화
  • mosec@mosecorg

    고성능 ML 모델 서빙 프레임워크로, 컴퓨팅 머신을 최대한 활용할 수 있도록 동적 배칭 및 CPU/GPU 파이프라인을 제공합니다.

    902+0최근 7일 스타 변화
  • ServerlessLLM@ServerlessLLM

    모두를 위한 Serverless LLM 서빙.

    711+6최근 7일 스타 변화
  • timber@kossisoroyce

    전통적인 ML 모델을 위한 Ollama입니다. XGBoost, LightGBM, scikit-learn, CatBoost 및 ONNX 모델을 네이티브 C99 추론 코드로 변환하는 AOT 컴파일러로, Python 추론 대비 336배 빠릅니다.

    687-1최근 7일 스타 변화
  • pegainfer@pegainfer-project

    Pure Rust + CUDA LLM 추론 엔진 — PyTorch 미사용, OpenAI 호환, Qwen3에서 Kimi-K2까지 서비스 제공

    660+4최근 7일 스타 변화
  • fastapi-ml-skeleton@eightBEC

    머신러닝 모델을 프로덕션 환경에서 서비스하기 위한 FastAPI 스켈레톤 앱

    603-1최근 7일 스타 변화
  • ome@ome-projects

    Open Model Engine (OME) — Kubernetes operator for LLM serving, GPU scheduling, and model lifecycle management. Works with SGLang, vLLM, TensorRT-LLM, and Triton

    502최근 7일 스타 변화
← 토픽 목록으로