Lompat ke konten utama
buildradar
Sign in
Topik · model-serving

model-serving

Repositori open source terpantau bertanda model-serving, diurutkan berdasarkan bintang.

Repositori
29
Total bintang
164.226
Rata-rata bintang
5.663
Porsi
0,01%

Topik yang sering muncul berdampingan dengan model-serving di repositori yang sama.

Yang sedang naik

Repositori yang dibuat dalam 90 hari terakhir dan bertanda model-serving.

Tidak ada repositori baru bertanda topik ini dalam 90 hari terakhir.

  • vllm@vllm-project

    Mesin inferensi dan serving ber-throughput tinggi serta hemat memori untuk LLM

    90.415+745Perubahan bintang dalam 7 hari terakhir
  • BentoML@bentoml

    Cara termudah untuk melayani aplikasi dan model AI - Membangun API inferensi model, antrean tugas, aplikasi LLM, pipeline multi-model, dan banyak lagi.

    8.813+18Perubahan bintang dalam 7 hari terakhir
  • vllm-omni@vllm-project

    Framework untuk inferensi model yang efisien dengan model omni-modality

    6.457+229Perubahan bintang dalam 7 hari terakhir
  • kserve@kserve

    Platform inferensi AI generatif dan prediktif terdistribusi yang terstandarisasi untuk penerapan multi-framework yang skalabel di Kubernetes.

    5.840+25Perubahan bintang dalam 7 hari terakhir
  • Olares@beclab

    OS Cloud Pribadi sumber terbuka untuk agen yang selalu aktif.

    5.243+10Perubahan bintang dalam 7 hari terakhir
  • Repositori ini berisi catatan dan referensi berguna mengenai penerapan model berbasis deep learning ke dalam produksi.

    4.376+1Perubahan bintang dalam 7 hari terakhir
  • 🚀 Sistem Hebat untuk Machine Learning ⚡️ Makalah Sistem AI dan Praktik Industri. ⚡️ Sistem untuk Machine Learning, LLM (Large Language Model), GenAI (Generative AI). 🍻 OSDI, NSDI, SIGCOMM, SoCC, MLSys, dll. 🗃️ Llama3, Mistral, dll. 🧑‍💻 Tutorial Video.

    4.318+27Perubahan bintang dalam 7 hari terakhir
  • LightLLM@ModelTC

    LightLLM adalah framework inferensi dan penyajian LLM (Large Language Model) berbasis Python, yang dikenal karena desainnya yang ringan, skalabilitas yang mudah, dan performa berkecepatan tinggi.

    4.251+21Perubahan bintang dalam 7 hari terakhir
  • FedML@FedML-AI

    FEDML - Pustaka ML yang terpadu dan dapat diskalakan untuk pelatihan terdistribusi skala besar, penyajian model, dan federated learning. FEDML Launch, penjadwal lintas cloud, memungkinkan eksekusi pekerjaan AI apa pun di cloud GPU atau klaster on-premise mana pun. Dibangun di atas pustaka ini, TensorOpera AI (https://TensorOpera.ai) adalah platform AI generatif Anda dalam skala besar.

    4.061-1Perubahan bintang dalam 7 hari terakhir
  • lorax@predibase

    Server inferensi Multi-LoRA yang dapat diskalakan hingga ribuan LLM yang telah di-fine-tune.

    3.826-2Perubahan bintang dalam 7 hari terakhir
  • chitu@thu-pacman

    Kerangka kerja inferensi berkinerja tinggi untuk model bahasa besar, yang berfokus pada efisiensi, fleksibilitas, dan ketersediaan.

    2.998+5Perubahan bintang dalam 7 hari terakhir
  • vllm-ascend@vllm-project

    Plugin perangkat keras yang dikelola komunitas untuk vLLM di Ascend

    2.730+53Perubahan bintang dalam 7 hari terakhir
  • openlake@openlake-project

    OpenLake adalah mesin penyimpanan berkinerja tinggi untuk inferensi LLM dan pelatihan GPU yang efisien

    2.346+9Perubahan bintang dalam 7 hari terakhir
  • envd@tensorchord

    🏕️ Lingkungan pengembangan yang dapat direproduksi untuk manusia dan agen.

    2.227+3Perubahan bintang dalam 7 hari terakhir
  • aici@microsoft

    AICI: Prompt sebagai program (Wasm)

    2.076+0Perubahan bintang dalam 7 hari terakhir
  • mlrun@mlrun

    MLRun adalah platform MLOps open-source untuk membangun dan mengelola aplikasi ML berkelanjutan secara cepat di seluruh siklus hidupnya. MLRun terintegrasi ke dalam lingkungan pengembangan dan CI/CD Anda serta mengotomatiskan pengiriman data produksi, pipeline ML, dan aplikasi online.

    1.694+0Perubahan bintang dalam 7 hari terakhir
  • kitops@kitops-ml

    Alat DevOps sumber terbuka dari CNCF untuk memaketkan dan melakukan versi pada model AI/ML, dataset, kode, serta konfigurasi ke dalam OCI Artifact.

    1.409+5Perubahan bintang dalam 7 hari terakhir
  • rtp-llm@alibaba

    RTP-LLM: Mesin inferensi LLM performa tinggi Alibaba untuk berbagai aplikasi.

    1.320+6Perubahan bintang dalam 7 hari terakhir
  • hopsworks@logicalclocks

    Hopsworks - Platform AI yang intensif data dengan Feature Store

    1.303+1Perubahan bintang dalam 7 hari terakhir
  • truss@basetenlabs

    Cara termudah untuk menyajikan model AI/ML dalam produksi

    1.196+1Perubahan bintang dalam 7 hari terakhir
  • sglang-omni@sgl-project

    SGLang-Omni mendukung penyajian berkinerja tinggi untuk model TTS, ASR, ucapan, dan omni.

    978+70Perubahan bintang dalam 7 hari terakhir
  • Nanoflow@efeslab

    Kerangka kerja penayangan berkinerja tinggi yang berorientasi pada throughput untuk LLM

    974+0Perubahan bintang dalam 7 hari terakhir
  • model_server@openvinotoolkit

    Server inferensi yang dapat diskalakan untuk model yang dioptimalkan dengan OpenVINO™

    921+3Perubahan bintang dalam 7 hari terakhir
  • ZhiLight@zhihu

    Mesin akselerasi inferensi LLM yang sangat dioptimalkan untuk Llama dan variannya.

    908+0Perubahan bintang dalam 7 hari terakhir
  • mosec@mosecorg

    Framework penyajian model ML performa tinggi, menawarkan batching dinamis dan pipeline CPU/GPU untuk memaksimalkan mesin komputasi Anda

    902+0Perubahan bintang dalam 7 hari terakhir
  • ServerlessLLM@ServerlessLLM

    Penyajian LLM Tanpa Server untuk Semua Orang.

    711+6Perubahan bintang dalam 7 hari terakhir
  • timber@kossisoroyce

    Ollama untuk model ML klasik. Kompiler AOT yang mengubah model XGBoost, LightGBM, scikit-learn, CatBoost & ONNX menjadi kode inferensi C99 asli. Satu perintah untuk memuat, satu perintah untuk melayani. 336x lebih cepat daripada inferensi Python.

    687-1Perubahan bintang dalam 7 hari terakhir
  • pegainfer@pegainfer-project

    Mesin inferensi LLM murni Rust + CUDA — tanpa PyTorch, kompatibel dengan OpenAI, melayani Qwen3 hingga Kimi-K2

    660+4Perubahan bintang dalam 7 hari terakhir
  • fastapi-ml-skeleton@eightBEC

    Aplikasi Kerangka Kerja FastAPI untuk menyajikan model machine learning yang siap diproduksi.

    603-1Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik