inference
inference 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.
- #61
Envoy Gateway 기반의 생성형 AI 서비스 통합 액세스 관리
★ 1,990+16최근 7일 스타 변화 - #62★ 1,927+4최근 7일 스타 변화
- #63
AgiBot X1용 추론 모듈
★ 1,835+1최근 7일 스타 변화 - #64★ 1,711+1최근 7일 스타 변화
- #65
🤗 Hugging Face 트랜스포머 모델을 위한 효율적이고 확장 가능한 엔터프라이즈급 CPU/GPU 추론 서버 🚀
★ 1,690+0최근 7일 스타 변화 - #66★ 1,687+4최근 7일 스타 변화
- #67
오픈 소스 지속적 추론 벤치마크 연구 플랫폼 — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 및 곧 출시될™ TPUv6e/v7/Trainium2/3
★ 1,613+33최근 7일 스타 변화 - #68
통합 API 인터페이스를 통해 여러 제공업체에 걸쳐 LLM 요청을 라우팅, 관리 및 분석합니다.
★ 1,594+8최근 7일 스타 변화 - #69★ 1,552+11최근 7일 스타 변화
- #70
CPU와 GPU에서 transformer 추론(Bert, Albert, GPT2, Decoders 등)을 위한 빠르고 사용자 친화적인 런타임
★ 1,550+1최근 7일 스타 변화 - #71
nvidia-smi 바이너리 또는 NVML을 사용하는 prometheus용 Nvidia GPU 익스포터
★ 1,550+4최근 7일 스타 변화 - #72★ 1,343+0최근 7일 스타 변화
- #73★ 1,325+6최근 7일 스타 변화
- #74
Rust로 작성된 고성능, 모듈식, 메모리 안전 및 프로덕션준비가 완료된 추론, 수집 및 인덱싱 엔진입니다 🦀
★ 1,305-1최근 7일 스타 변화 - #75
그래프 및 쌍(pairwise) 설정에서의 인과 추론 패키지. 그래프 구조 복구 및 종속성 도구가 포함되어 있습니다.
★ 1,237+0최근 7일 스타 변화 - #76★ 1,224+0최근 7일 스타 변화
- #77★ 1,201+5최근 7일 스타 변화
- #78
성능(지연 시간, 메모리 등)에 최적화되고 Qualcomm® 기기에 바로 배포할 수 있는 최신 머신러닝 모델 모음인 Qualcomm® AI Hub Models입니다.
★ 1,195+1최근 7일 스타 변화 - #79
SGLang-Omni는 TTS, ASR, 음성 및 옴니 모델을 위한 고성능 서빙을 지원합니다.
★ 1,118+143최근 7일 스타 변화 - #80
Apple Silicon용 네이티브 LLM 추론 서버. OpenAI 및 Anthropic API 호환. Python 미사용. 채팅, 에이전트 모드, 도구 호출을 지원하는 MLX Core macOS 앱 포함.
★ 1,115+245최근 7일 스타 변화 - #81★ 1,094+15최근 7일 스타 변화
- #82★ 975+1최근 7일 스타 변화
- #83★ 964+6최근 7일 스타 변화
- #84★ 957+0최근 7일 스타 변화
- #85★ 944+1최근 7일 스타 변화
- #86★ 943+0최근 7일 스타 변화
- #87
OpenVINO™로 최적화된 모델을 위한 확장 가능한 추론 서버
★ 927+5최근 7일 스타 변화 - #88★ 867+1최근 7일 스타 변화
- #89★ 851-1최근 7일 스타 변화
- #90★ 848+0최근 7일 스타 변화