Lompat ke konten utama
buildradar
Sign in
Topik · inference

inference

Repositori open source terpantau bertanda inference, diurutkan berdasarkan bintang.

120 repositori
  • ai-gateway@envoyproxy

    Mengelola Akses Terpadu ke Layanan AI Generatif yang dibangun di atas Envoy Gateway

    1.990+16Perubahan bintang dalam 7 hari terakhir
  • picolm@RightNow-AI

    Jalankan LLM 1 miliar parameter pada papan $10 dengan RAM 256MB

    1.927+4Perubahan bintang dalam 7 hari terakhir
  • agibot_x1_infer@AgibotTech

    Modul inferensi untuk AgiBot X1.

    1.835+1Perubahan bintang dalam 7 hari terakhir
  • NNPACK@Maratyszcza

    Paket akselerasi untuk jaringan saraf pada CPU multi-inti

    1.711+1Perubahan bintang dalam 7 hari terakhir
  • Server inferensi CPU/GPU yang efisien, dapat disesuaikan, dan tingkat enterprise untuk model transformer 🤗 Hugging Face 🚀

    1.690+0Perubahan bintang dalam 7 hari terakhir
  • uzu@trymirai

    Mesin inferensi performa tinggi untuk model AI

    1.687+4Perubahan bintang dalam 7 hari terakhir
  • InferenceX@SemiAnalysisAI

    Platform Riset Benchmark Inferensi Berkelanjutan Open Source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & segera hadir™ TPUv6e/v7/Trainium2/3 | Platform riset benchmark inferensi berkelanjutan open-source — Kimi K2.7-Code, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72, segera hadir™ TPUv6e/v7/Trainium2/3

    1.613+33Perubahan bintang dalam 7 hari terakhir
  • llmgateway@theopenco

    Rute, kelola, dan analisis permintaan LLM Anda di berbagai penyedia dengan antarmuka API yang bersatu.

    1.594+8Perubahan bintang dalam 7 hari terakhir
  • xllm@xLLM-AI

    Mesin inferensi performa tinggi untuk model LLM, VLM, DiT, dan REC, yang dioptimalkan untuk berbagai akselerator AI. Dihosting di OpenAtom Foundation.

    1.552+11Perubahan bintang dalam 7 hari terakhir
  • Runtime yang cepat dan ramah pengguna untuk inferensi transformer (Bert, Albert, GPT2, Decoders, dll.) pada CPU dan GPU.

    1.550+1Perubahan bintang dalam 7 hari terakhir
  • Exporter GPU Nvidia untuk prometheus menggunakan biner nvidia-smi atau menggunakan NVML

    1.550+4Perubahan bintang dalam 7 hari terakhir
  • budgetml@ebhy

    Dapatkan layanan inferensi ML dengan anggaran terbatas dalam waktu kurang dari 10 baris kode.

    1.343+0Perubahan bintang dalam 7 hari terakhir
  • rtp-llm@alibaba

    RTP-LLM: Mesin inferensi LLM performa tinggi Alibaba untuk berbagai aplikasi.

    1.325+6Perubahan bintang dalam 7 hari terakhir
  • EmbedAnything@StarlightSearch

    Inferensi, Ingestion, dan Pengindeksan yang Sangat Berkinerja, Modular, Aman dari Memori, dan Siap Produksi yang dibangun dengan Rust 🦀

    1.305-1Perubahan bintang dalam 7 hari terakhir
  • CausalDiscoveryToolbox@FenTechSolutions

    Paket untuk inferensi kausal dalam grafik dan pengaturan berpasangan. Termasuk alat untuk pemulihan struktur grafik dan dependensi.

    1.237+0Perubahan bintang dalam 7 hari terakhir
  • kubetorch@run-house

    Distribusikan dan jalankan beban kerja AI di Kubernetes secara ajaib dengan Python, seperti PyTorch untuk infrastruktur ML.

    1.224+0Perubahan bintang dalam 7 hari terakhir
  • kvpress@NVIDIA

    Kompresi KV cache LLM menjadi lebih mudah

    1.201+5Perubahan bintang dalam 7 hari terakhir
  • ai-hub-models@qualcomm

    Qualcomm® AI Hub Models adalah koleksi model machine learning canggih yang dioptimalkan untuk performa (latensi, memori, dll.) dan siap diterapkan di perangkat Qualcomm®.

    1.195+1Perubahan bintang dalam 7 hari terakhir
  • sglang-omni@sgl-project

    SGLang-Omni mendukung penyajian berkinerja tinggi untuk model TTS, ASR, ucapan, dan omni.

    1.118+130Perubahan bintang dalam 7 hari terakhir
  • mlx-serve@ddalcu

    Server inferensi LLM native untuk Apple Silicon. Kompatibel dengan API OpenAI + Anthropic. Tanpa Python. Termasuk aplikasi macOS MLX Core dengan obrolan, mode agen, dan pemanggilan alat.

    1.115+245Perubahan bintang dalam 7 hari terakhir
  • tiny-vllm@jmaczan

    Bangun mesin inferensi LLM berkinerja tinggi Anda sendiri dalam C++ dan CUDA - versi yang lebih kecil dari vLLM.

    1.094+15Perubahan bintang dalam 7 hari terakhir
  • Nanoflow@efeslab

    Kerangka kerja penayangan berkinerja tinggi yang berorientasi pada throughput untuk LLM

    975+1Perubahan bintang dalam 7 hari terakhir
  • mlxstudio@jjang-ai

    MLX Studio - Rumah JANG_Q - Pembuatan/Pengeditan Gambar + Obrolan/Kode Semua dalam satu - + OpenClaw (Anthropic API)

    965+4Perubahan bintang dalam 7 hari terakhir
  • bolt@huawei-noah

    Bolt adalah library deep learning dengan performa tinggi dan fleksibilitas heterogen.

    957+0Perubahan bintang dalam 7 hari terakhir
  • ims@OpenIntroStat

    📚 Pengantar Statistik Modern - Buku teks sumber terbuka tingkat perguruan tinggi dengan pendekatan modern yang menyoroti hubungan multivariabel dan inferensi berbasis simulasi.

    944+0Perubahan bintang dalam 7 hari terakhir
  • neuropod@uber

    Antarmuka seragam untuk menjalankan model deep learning dari berbagai framework

    943+0Perubahan bintang dalam 7 hari terakhir
  • model_server@openvinotoolkit

    Server inferensi yang dapat diskalakan untuk model yang dioptimalkan dengan OpenVINO™

    925+5Perubahan bintang dalam 7 hari terakhir
  • bark.cpp@PABannier

    Model Bark Suno AI dalam C/C++ untuk pembuatan text-to-speech yang cepat

    867+1Perubahan bintang dalam 7 hari terakhir
  • pipeless@pipeless-ai

    Kerangka kerja computer vision open-source untuk membangun dan menerapkan aplikasi dalam hitungan menit

    851+0Perubahan bintang dalam 7 hari terakhir
  • pytriton@triton-inference-server

    PyTriton adalah antarmuka mirip Flask/FastAPI yang menyederhanakan penerapan Triton di lingkungan Python.

    848+0Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik