llm-serving
llm-serving 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
관련 토픽
같은 리포지토리에 llm-serving 태그와 자주 함께 쓰이는 토픽이에요.
최근 라이징
최근 90일 안에 만들어지고 llm-serving 태그가 달린 리포지토리예요.
최근 90일 안에 이 토픽 태그가 달린 새 리포지토리가 없어요.
- #1★ 90,817+402최근 7일 스타 변화
- #2★ 43,688+41최근 7일 스타 변화
- #3
본 프로젝트는 대형 모델 관련 기술 원리 및 실전 경험(대형 모델 엔지니어링, 대형 모델 애플리케이션 구현)을 공유하는 것을 목표로 합니다.
★ 24,995+21최근 7일 스타 변화 - #4
TensorRT LLM은 사용자가 대규모 언어 모델(LLM)을 정의할 수 있는 사용하기 쉬운 Python API를 제공하며, NVIDIA GPU에서 효율적으로 추론을 수행할 수 있는 최신 최적화를 지원합니다. 또한 TensorRT LLM에는 고성능 방식으로 추론 실행을 조율하는 Python 및 C++ 런타임을 생성하는 구성 요소가 포함되어 있습니다.
★ 14,536+38최근 7일 스타 변화 - #5★ 12,524+1최근 7일 스타 변화
- #6
프론티어 팀을 위한 AI 연산 플랫폼입니다. SkyPilot은 분산된 AI 연산을 하나의 AI 슈퍼컴퓨터로 통합하여, 프론티어 AI 팀이 맞춤형 인공지능을 더 빠르게 구축할 수 있도록 지원합니다.
★ 10,550+16최근 7일 스타 변화 - #7★ 8,817+4최근 7일 스타 변화
- #8★ 5,593+21최근 7일 스타 변화
- #9
Superduper: 맞춤형 AI 애플리케이션 및 에이전트 구축을 위한 엔드투엔드 프레임워크
★ 5,318+1최근 7일 스타 변화 - #10★ 3,827+1최근 7일 스타 변화
- #11
PaddlePaddle 기반의 LLM 및 VLM을 위한 고성능 추론 및 배포 툴킷
★ 3,714+3최근 7일 스타 변화 - #12★ 2,997-1최근 7일 스타 변화
- #13
Ascend 기반 vLLM을 위한 커뮤니티 유지보수 하드웨어 플러그인
★ 2,749+19최근 7일 스타 변화 - #14★ 2,174+1최근 7일 스타 변화
- #15★ 2,076+0최근 7일 스타 변화
- #16
오픈 소스 지속적 추론 벤치마크 연구 플랫폼 — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 및 곧 출시될™ TPUv6e/v7/Trainium2/3
★ 1,613+33최근 7일 스타 변화 - #17★ 1,372+4최근 7일 스타 변화
- #18★ 1,325+6최근 7일 스타 변화
- #19★ 1,275+130최근 7일 스타 변화
- #20★ 975+1최근 7일 스타 변화
- #21★ 908+0최근 7일 스타 변화
- #22★ 902+0최근 7일 스타 변화
- #23
♾️ Spec 코딩을 지원하는 프라이빗 에이전트 플릿. 각 에이전트는 전용 GPU 가속 데스크톱을 할당받습니다. 완전한 프라이빗 AI 스택에서 Claude, Codex, Gemini 및 오픈 모델을 실행하세요 ♾️
★ 804+1최근 7일 스타 변화 - #24
Pure Rust + CUDA LLM 추론 엔진 — PyTorch 미사용, OpenAI 호환, Qwen3에서 Kimi-K2까지 서비스 제공
★ 673+14최근 7일 스타 변화 - #25
LLM(대규모 언어 모델) 파인튜닝
★ 579+1최근 7일 스타 변화