본문으로 건너뛰기
buildradar
Sign in
토픽 · inference

inference

inference 태그가 달린 추적 중인 오픈소스 리포지토리를 스타 수 순으로 보여줘요.

리포지토리 120개
  • tensorrt-cpp-api@cyrusbehr

    TensorRT C++ API 튜토리얼

    811+0최근 7일 스타 변화
  • cppflow@serizba

    별도의 설치나 Bazel 없이 C++에서 TensorFlow 모델 실행하기

    803-1최근 7일 스타 변화
  • reef@Human-Agent-Society

    Continual learning infra for self-improving agents

    774최근 7일 스타 변화
  • filetype.py@h2non

    매직 넘버 서명을 확인하여 바이너리 파일 타입을 유추하는 작고 의존성 없는 빠른 Python 패키지

    773+2최근 7일 스타 변화
  • studio-lab-examples@aws

    SageMaker Studio Lab 작업용 예제 노트북입니다. 아래 링크에서 계정을 가입하세요!

    772+1최근 7일 스타 변화
  • APT@rnchg

    AI 생산성 도구 - 무료 오픈소스, 사용자 생산성 향상 및 프라이버시와 데이터 보안 보호. 포함 내용(이에 국한되지 않음): 내장형 로컬 전용 ChatGPT, DeepSeek, Phi, Qwen 등의 모델, 이미지·비디오·오디오 등의 원클릭 일괄 지능형 처리.

    768+0최근 7일 스타 변화
  • SwiftLM@SharpAI

    Apple Silicon용 네이티브 MLX Swift LLM 추론 서버입니다. OpenAI 호환 API, 100B+ MoE 모델을 위한 SSD 스트리밍, TurboQuant KV 캐시 압축, macOS 및 iOS 앱을 지원합니다.

    760+8최근 7일 스타 변화
  • InferLLM@MegEngine

    경량 LLM 모델 추론 프레임워크

    753+0최근 7일 스타 변화
  • emlearn@emlearn

    마이크로컨트롤러 및 임베디드 장치를 위한 머신러닝 추론 엔진

    753+5최근 7일 스타 변화
  • identYwaf@stamparm

    블라인드 WAF 식별 도구

    748+3최근 7일 스타 변화
  • yolort@zhiqwang

    yolort는 tensorrt, libtorch, onnxruntime, tvm, ncnn 등 특화된 가속기에서 yolov5를 실행하기 위한 런타임 스택입니다.

    730+0최근 7일 스타 변화
  • ml_privacy_meter@privacytrustlab

    Privacy Meter: 통계 및 머신러닝 알고리즘의 데이터 프라이버시를 감사하기 위한 오픈소스 라이브러리

    725+1최근 7일 스타 변화
  • kglab@DerwenAI

    Graph Data Science: Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow 등과 통합되어 지식 그래프를 구축하기 위한 Python 추상화 계층

    691+2최근 7일 스타 변화
  • timber@kossisoroyce

    전통적인 ML 모델을 위한 Ollama입니다. XGBoost, LightGBM, scikit-learn, CatBoost 및 ONNX 모델을 네이티브 C99 추론 코드로 변환하는 AOT 컴파일러로, Python 추론 대비 336배 빠릅니다.

    687+0최근 7일 스타 변화
  • TrainYourOwnYOLO@AntonMu

    최신 YOLOv3 객체 탐지기를 처음부터 학습

    677+0최근 7일 스타 변화
  • pegainfer@pegainfer-project

    Pure Rust + CUDA LLM 추론 엔진 — PyTorch 미사용, OpenAI 호환, Qwen3에서 Kimi-K2까지 서비스 제공

    676+18최근 7일 스타 변화
  • vidur@microsoft

    LLM 추론 시스템을 위한 정확하고 확장 가능한 대규모 시뮬레이터

    673+5최근 7일 스타 변화
  • libonnx@xboot

    하드웨어 가속을 지원하는 임베디드 장치용 경량 휴대용 순수 C99 ONNX 추론 엔진입니다.

    652+0최근 7일 스타 변화
  • waverless@WaveSpeedAI

    고성능 서버리스 GPU 작업 오케스트레이션 — wavespeed.ai의 스케줄링 계층

    632+0최근 7일 스타 변화
  • Deepdive-llama3-from-scratch@therealoliver

    llama3 추론 과정을 단계별로 학습하고 핵심 개념 파악, 프로세스 유도 및 코드 구현

    630+0최근 7일 스타 변화
  • dlstreamer@open-edge-platform

    Deep Learning Streamer(DL Streamer) 파이프라인 프레임워크는 GStreamer 멀티미디어 프레임워크를 기반으로 클라우드나 엣지에서 복잡한 미디어 분석 파이프라인을 구축하기 위한 오픈 소스 스트리밍 미디어 분석 프레임워크입니다.

    622-1최근 7일 스타 변화
  • mmdetection 모델을 TensorRT로 변환 (fp16, int8, 배치 입력, 동적 형태 지원)

    596+0최근 7일 스타 변화
  • inferoa@agentic-in

    Inference-native Tokenmaxxing Agent Harness for Loop Engineering

    561최근 7일 스타 변화
  • YOLO 소형 객체 탐지 및 인스턴스 분할을 위한 Python 라이브러리

    557+0최근 7일 스타 변화
  • BigMoeOnEdge@Helldez

    Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp

    548최근 7일 스타 변화
  • aikit@kaito-project

    🏗️ 오픈소스 LLM을 간편하게 미세조정, 빌드 및 배포하세요!

    539+2최근 7일 스타 변화
  • kubedl@kubedl-io

    Kubernetes에서 딥러닝 워크로드를 더 쉽고 효율적으로 실행

    532+1최근 7일 스타 변화
  • model_analyzer@triton-inference-server

    Triton Model Analyzer는 Triton Inference Server 모델의 연산 및 메모리 요구 사항을 더 잘 이해하도록 돕는 CLI 도구입니다.

    526+0최근 7일 스타 변화
  • nanoowl@NVIDIA-AI-IOT

    A project that optimizes OWL-ViT for real-time inference with NVIDIA TensorRT.

    514+8최근 7일 스타 변화
  • blindai@mithril-security

    보안 엔클레이브(Secure Enclave)를 활용한 기밀 AI 배포

    512+0최근 7일 스타 변화
← 토픽 목록으로