inference
Repositori open source terpantau bertanda inference, diurutkan berdasarkan bintang.
- #61
Mengelola Akses Terpadu ke Layanan AI Generatif yang dibangun di atas Envoy Gateway
★ 1.990+16Perubahan bintang dalam 7 hari terakhir - #62★ 1.927+4Perubahan bintang dalam 7 hari terakhir
- #63
Modul inferensi untuk AgiBot X1.
★ 1.835+1Perubahan bintang dalam 7 hari terakhir - #64★ 1.711+1Perubahan bintang dalam 7 hari terakhir
- #65
Server inferensi CPU/GPU yang efisien, dapat disesuaikan, dan tingkat enterprise untuk model transformer 🤗 Hugging Face 🚀
★ 1.690+0Perubahan bintang dalam 7 hari terakhir - #66★ 1.687+4Perubahan bintang dalam 7 hari terakhir
- #67
Platform Riset Benchmark Inferensi Berkelanjutan Open Source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & segera hadir™ TPUv6e/v7/Trainium2/3 | Platform riset benchmark inferensi berkelanjutan open-source — Kimi K2.7-Code, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72, segera hadir™ TPUv6e/v7/Trainium2/3
★ 1.613+33Perubahan bintang dalam 7 hari terakhir - #68
Rute, kelola, dan analisis permintaan LLM Anda di berbagai penyedia dengan antarmuka API yang bersatu.
★ 1.594+8Perubahan bintang dalam 7 hari terakhir - #69
Mesin inferensi performa tinggi untuk model LLM, VLM, DiT, dan REC, yang dioptimalkan untuk berbagai akselerator AI. Dihosting di OpenAtom Foundation.
★ 1.552+11Perubahan bintang dalam 7 hari terakhir - #70
Runtime yang cepat dan ramah pengguna untuk inferensi transformer (Bert, Albert, GPT2, Decoders, dll.) pada CPU dan GPU.
★ 1.550+1Perubahan bintang dalam 7 hari terakhir - #71
Exporter GPU Nvidia untuk prometheus menggunakan biner nvidia-smi atau menggunakan NVML
★ 1.550+4Perubahan bintang dalam 7 hari terakhir - #72
Dapatkan layanan inferensi ML dengan anggaran terbatas dalam waktu kurang dari 10 baris kode.
★ 1.343+0Perubahan bintang dalam 7 hari terakhir - #73★ 1.325+6Perubahan bintang dalam 7 hari terakhir
- #74
Inferensi, Ingestion, dan Pengindeksan yang Sangat Berkinerja, Modular, Aman dari Memori, dan Siap Produksi yang dibangun dengan Rust 🦀
★ 1.305-1Perubahan bintang dalam 7 hari terakhir - #75
Paket untuk inferensi kausal dalam grafik dan pengaturan berpasangan. Termasuk alat untuk pemulihan struktur grafik dan dependensi.
★ 1.237+0Perubahan bintang dalam 7 hari terakhir - #76
Distribusikan dan jalankan beban kerja AI di Kubernetes secara ajaib dengan Python, seperti PyTorch untuk infrastruktur ML.
★ 1.224+0Perubahan bintang dalam 7 hari terakhir - #77★ 1.201+5Perubahan bintang dalam 7 hari terakhir
- #78
Qualcomm® AI Hub Models adalah koleksi model machine learning canggih yang dioptimalkan untuk performa (latensi, memori, dll.) dan siap diterapkan di perangkat Qualcomm®.
★ 1.195+1Perubahan bintang dalam 7 hari terakhir - #79
SGLang-Omni mendukung penyajian berkinerja tinggi untuk model TTS, ASR, ucapan, dan omni.
★ 1.118+130Perubahan bintang dalam 7 hari terakhir - #80
Server inferensi LLM native untuk Apple Silicon. Kompatibel dengan API OpenAI + Anthropic. Tanpa Python. Termasuk aplikasi macOS MLX Core dengan obrolan, mode agen, dan pemanggilan alat.
★ 1.115+245Perubahan bintang dalam 7 hari terakhir - #81
Bangun mesin inferensi LLM berkinerja tinggi Anda sendiri dalam C++ dan CUDA - versi yang lebih kecil dari vLLM.
★ 1.094+15Perubahan bintang dalam 7 hari terakhir - #82
Kerangka kerja penayangan berkinerja tinggi yang berorientasi pada throughput untuk LLM
★ 975+1Perubahan bintang dalam 7 hari terakhir - #83
MLX Studio - Rumah JANG_Q - Pembuatan/Pengeditan Gambar + Obrolan/Kode Semua dalam satu - + OpenClaw (Anthropic API)
★ 965+4Perubahan bintang dalam 7 hari terakhir - #84
Bolt adalah library deep learning dengan performa tinggi dan fleksibilitas heterogen.
★ 957+0Perubahan bintang dalam 7 hari terakhir - #85
📚 Pengantar Statistik Modern - Buku teks sumber terbuka tingkat perguruan tinggi dengan pendekatan modern yang menyoroti hubungan multivariabel dan inferensi berbasis simulasi.
★ 944+0Perubahan bintang dalam 7 hari terakhir - #86★ 943+0Perubahan bintang dalam 7 hari terakhir
- #87
Server inferensi yang dapat diskalakan untuk model yang dioptimalkan dengan OpenVINO™
★ 925+5Perubahan bintang dalam 7 hari terakhir - #88★ 867+1Perubahan bintang dalam 7 hari terakhir
- #89
Kerangka kerja computer vision open-source untuk membangun dan menerapkan aplikasi dalam hitungan menit
★ 851+0Perubahan bintang dalam 7 hari terakhir - #90
PyTriton adalah antarmuka mirip Flask/FastAPI yang menyederhanakan penerapan Triton di lingkungan Python.
★ 848+0Perubahan bintang dalam 7 hari terakhir