본문으로 건너뛰기
buildradar
Sign in
토픽 · inference

inference

inference 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 120개
  • ai-gateway@envoyproxy

    Envoy Gateway 기반의 생성형 AI 서비스 통합 액세스 관리

    1,990+16최근 7일 스타 변화
  • picolm@RightNow-AI

    256MB RAM이 탑재된 10달러짜리 보드에서 10억 개의 매개변수를 가진 LLM 실행

    1,927+4최근 7일 스타 변화
  • agibot_x1_infer@AgibotTech

    AgiBot X1용 추론 모듈

    1,835+1최근 7일 스타 변화
  • NNPACK@Maratyszcza

    멀티코어 CPU용 신경망 가속 패키지

    1,711+1최근 7일 스타 변화
  • 🤗 Hugging Face 트랜스포머 모델을 위한 효율적이고 확장 가능한 엔터프라이즈급 CPU/GPU 추론 서버 🚀

    1,690+0최근 7일 스타 변화
  • uzu@trymirai

    AI 모델을 위한 고성능 추론 엔진

    1,687+4최근 7일 스타 변화
  • InferenceX@SemiAnalysisAI

    오픈 소스 지속적 추론 벤치마크 연구 플랫폼 — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 및 곧 출시될™ TPUv6e/v7/Trainium2/3

    1,613+33최근 7일 스타 변화
  • llmgateway@theopenco

    통합 API 인터페이스를 통해 여러 제공업체에 걸쳐 LLM 요청을 라우팅, 관리 및 분석합니다.

    1,594+8최근 7일 스타 변화
  • xllm@xLLM-AI

    다양한 AI 가속기에 최적화된 LLM, VLM, DiT 및 REC 모델을 위한 고성능 추론 엔진. OpenAtom Foundation에서 호스팅됩니다.

    1,552+11최근 7일 스타 변화
  • CPU와 GPU에서 transformer 추론(Bert, Albert, GPT2, Decoders 등)을 위한 빠르고 사용자 친화적인 런타임

    1,550+1최근 7일 스타 변화
  • nvidia-smi 바이너리 또는 NVML을 사용하는 prometheus용 Nvidia GPU 익스포터

    1,550+4최근 7일 스타 변화
  • budgetml@ebhy

    10줄 미만의 코드로 저비용 ML 추론 서비스를 배포하세요.

    1,343+0최근 7일 스타 변화
  • rtp-llm@alibaba

    RTP-LLM: 다양한 애플리케이션을 위한 Alibaba의 고성능 LLM 추론 엔진.

    1,325+6최근 7일 스타 변화
  • EmbedAnything@StarlightSearch

    Rust로 작성된 고성능, 모듈식, 메모리 안전 및 프로덕션준비가 완료된 추론, 수집 및 인덱싱 엔진입니다 🦀

    1,305-1최근 7일 스타 변화
  • CausalDiscoveryToolbox@FenTechSolutions

    그래프 및 쌍(pairwise) 설정에서의 인과 추론 패키지. 그래프 구조 복구 및 종속성 도구가 포함되어 있습니다.

    1,237+0최근 7일 스타 변화
  • kubetorch@run-house

    ML 인프라를 위한 PyTorch처럼, Python에서 Kubernetes로 AI 워크로드 분산 및 실행을 마법처럼 처리

    1,224+0최근 7일 스타 변화
  • kvpress@NVIDIA

    간편한 LLM KV 캐시 압축 도구

    1,201+5최근 7일 스타 변화
  • ai-hub-models@qualcomm

    성능(지연 시간, 메모리 등)에 최적화되고 Qualcomm® 기기에 바로 배포할 수 있는 최신 머신러닝 모델 모음인 Qualcomm® AI Hub Models입니다.

    1,195+1최근 7일 스타 변화
  • sglang-omni@sgl-project

    SGLang-Omni는 TTS, ASR, 음성 및 옴니 모델을 위한 고성능 서빙을 지원합니다.

    1,118+143최근 7일 스타 변화
  • mlx-serve@ddalcu

    Apple Silicon용 네이티브 LLM 추론 서버. OpenAI 및 Anthropic API 호환. Python 미사용. 채팅, 에이전트 모드, 도구 호출을 지원하는 MLX Core macOS 앱 포함.

    1,115+245최근 7일 스타 변화
  • tiny-vllm@jmaczan

    C++ 및 CUDA로 구축하는 고성능 LLM 추론 엔진 - vLLM의 경량 버전

    1,094+15최근 7일 스타 변화
  • Nanoflow@efeslab

    LLM을 위한 처리량 중심의 고성능 서빙 프레임워크

    975+1최근 7일 스타 변화
  • mlxstudio@jjang-ai

    MLX Studio - JANG_Q의 홈 - 이미지 생성/편집 + 채팅/코드 올인원 - + OpenClaw (Anthropic API)

    964+6최근 7일 스타 변화
  • bolt@huawei-noah

    Bolt는 고성능과 이기종 유연성을 갖춘 딥러닝 라이브러리입니다.

    957+0최근 7일 스타 변화
  • ims@OpenIntroStat

    📚 현대 통계학 입문 - 다변수 관계와 시뮬레이션 기반 추론을 강조하는 현대적 접근 방식의 대학 수준 오픈소스 교과서

    944+1최근 7일 스타 변화
  • neuropod@uber

    다양한 프레임워크의 딥러닝 모델을 실행하기 위한 통합 인터페이스

    943+0최근 7일 스타 변화
  • model_server@openvinotoolkit

    OpenVINO™로 최적화된 모델을 위한 확장 가능한 추론 서버

    927+5최근 7일 스타 변화
  • bark.cpp@PABannier

    빠른 텍스트 음성 변환(TTS) 생성을 위한 Suno AI Bark 모델의 C/C++ 구현체

    867+1최근 7일 스타 변화
  • pipeless@pipeless-ai

    몇 분 만에 앱을 구축하고 배포할 수 있는 오픈 소스 컴퓨터 비전 프레임워크

    851-1최근 7일 스타 변화
  • pytriton@triton-inference-server

    PyTriton은 Python 환경에서 Triton 배포를 간소화하는 Flask/FastAPI 스타일의 인터페이스

    848+0최근 7일 스타 변화
← 토픽 목록으로