model-serving
Repositori open source terpantau bertanda model-serving, diurutkan berdasarkan bintang.
Topik terkait
Topik yang sering muncul berdampingan dengan model-serving di repositori yang sama.
Yang sedang naik
Repositori yang dibuat dalam 90 hari terakhir dan bertanda model-serving.
Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.
- #1★ 90.415+745Perubahan bintang dalam 7 hari terakhir
- #2
Cara termudah untuk melayani aplikasi dan model AI - Membangun API inferensi model, antrean tugas, aplikasi LLM, pipeline multi-model, dan banyak lagi.
★ 8.813+18Perubahan bintang dalam 7 hari terakhir - #3★ 6.457+229Perubahan bintang dalam 7 hari terakhir
- #4
Platform inferensi AI generatif dan prediktif terdistribusi yang terstandarisasi untuk penerapan multi-framework yang skalabel di Kubernetes.
★ 5.840+25Perubahan bintang dalam 7 hari terakhir - #5★ 5.243+10Perubahan bintang dalam 7 hari terakhir
- #6
Repositori ini berisi catatan dan referensi berguna mengenai penerapan model berbasis deep learning ke dalam produksi.
★ 4.376+1Perubahan bintang dalam 7 hari terakhir - #7
🚀 Sistem Hebat untuk Machine Learning ⚡️ Makalah Sistem AI dan Praktik Industri. ⚡️ Sistem untuk Machine Learning, LLM (Large Language Model), GenAI (Generative AI). 🍻 OSDI, NSDI, SIGCOMM, SoCC, MLSys, dll. 🗃️ Llama3, Mistral, dll. 🧑💻 Tutorial Video.
★ 4.318+27Perubahan bintang dalam 7 hari terakhir - #8
LightLLM adalah framework inferensi dan penyajian LLM (Large Language Model) berbasis Python, yang dikenal karena desainnya yang ringan, skalabilitas yang mudah, dan performa berkecepatan tinggi.
★ 4.251+21Perubahan bintang dalam 7 hari terakhir - #9
FEDML - Pustaka ML yang terpadu dan dapat diskalakan untuk pelatihan terdistribusi skala besar, penyajian model, dan federated learning. FEDML Launch, penjadwal lintas cloud, memungkinkan eksekusi pekerjaan AI apa pun di cloud GPU atau klaster on-premise mana pun. Dibangun di atas pustaka ini, TensorOpera AI (https://TensorOpera.ai) adalah platform AI generatif Anda dalam skala besar.
★ 4.061-1Perubahan bintang dalam 7 hari terakhir - #10
Server inferensi Multi-LoRA yang dapat diskalakan hingga ribuan LLM yang telah di-fine-tune.
★ 3.826-2Perubahan bintang dalam 7 hari terakhir - #11
Kerangka kerja inferensi berkinerja tinggi untuk model bahasa besar, yang berfokus pada efisiensi, fleksibilitas, dan ketersediaan.
★ 2.998+5Perubahan bintang dalam 7 hari terakhir - #12
Plugin perangkat keras yang dikelola komunitas untuk vLLM di Ascend
★ 2.730+53Perubahan bintang dalam 7 hari terakhir - #13
OpenLake adalah mesin penyimpanan berkinerja tinggi untuk inferensi LLM dan pelatihan GPU yang efisien
★ 2.346+9Perubahan bintang dalam 7 hari terakhir - #14★ 2.227+3Perubahan bintang dalam 7 hari terakhir
- #15★ 2.076+0Perubahan bintang dalam 7 hari terakhir
- #16
MLRun adalah platform MLOps open-source untuk membangun dan mengelola aplikasi ML berkelanjutan secara cepat di seluruh siklus hidupnya. MLRun terintegrasi ke dalam lingkungan pengembangan dan CI/CD Anda serta mengotomatiskan pengiriman data produksi, pipeline ML, dan aplikasi online.
★ 1.694+0Perubahan bintang dalam 7 hari terakhir - #17
Alat DevOps sumber terbuka dari CNCF untuk memaketkan dan melakukan versi pada model AI/ML, dataset, kode, serta konfigurasi ke dalam OCI Artifact.
★ 1.409+5Perubahan bintang dalam 7 hari terakhir - #18★ 1.320+6Perubahan bintang dalam 7 hari terakhir
- #19★ 1.303+1Perubahan bintang dalam 7 hari terakhir
- #20★ 1.196+1Perubahan bintang dalam 7 hari terakhir
- #21
SGLang-Omni mendukung penyajian berkinerja tinggi untuk model TTS, ASR, ucapan, dan omni.
★ 978+70Perubahan bintang dalam 7 hari terakhir - #22
Kerangka kerja penayangan berkinerja tinggi yang berorientasi pada throughput untuk LLM
★ 974+0Perubahan bintang dalam 7 hari terakhir - #23
Server inferensi yang dapat diskalakan untuk model yang dioptimalkan dengan OpenVINO™
★ 921+3Perubahan bintang dalam 7 hari terakhir - #24★ 908+0Perubahan bintang dalam 7 hari terakhir
- #25
Framework penyajian model ML performa tinggi, menawarkan batching dinamis dan pipeline CPU/GPU untuk memaksimalkan mesin komputasi Anda
★ 902+0Perubahan bintang dalam 7 hari terakhir - #26
Penyajian LLM Tanpa Server untuk Semua Orang.
★ 711+6Perubahan bintang dalam 7 hari terakhir - #27
Ollama untuk model ML klasik. Kompiler AOT yang mengubah model XGBoost, LightGBM, scikit-learn, CatBoost & ONNX menjadi kode inferensi C99 asli. Satu perintah untuk memuat, satu perintah untuk melayani. 336x lebih cepat daripada inferensi Python.
★ 687-1Perubahan bintang dalam 7 hari terakhir - #28
Mesin inferensi LLM murni Rust + CUDA — tanpa PyTorch, kompatibel dengan OpenAI, melayani Qwen3 hingga Kimi-K2
★ 660+4Perubahan bintang dalam 7 hari terakhir - #29
Aplikasi Kerangka Kerja FastAPI untuk menyajikan model machine learning yang siap diproduksi.
★ 603-1Perubahan bintang dalam 7 hari terakhir