inference
Repositori open source terpantau bertanda inference, diurutkan berdasarkan bintang.
- #91
Tutorial API C++ TensorRT.
★ 811+0Perubahan bintang dalam 7 hari terakhir - #92★ 802-1Perubahan bintang dalam 7 hari terakhir
- #93
Contoh notebook untuk bekerja dengan SageMaker Studio Lab. Daftar akun melalui tautan di bawah!
★ 772+0Perubahan bintang dalam 7 hari terakhir - #94
Paket Python yang kecil, cepat, dan bebas dependensi untuk menyimpulkan jenis file biner dengan memeriksa tanda magic numbers
★ 772+2Perubahan bintang dalam 7 hari terakhir - #95
Alat Produktivitas AI - Gratis dan sumber terbuka, meningkatkan produktivitas pengguna, serta melindungi privasi dan keamanan data. Mencakup namun tidak terbatas pada: ChatGPT lokal eksklusif bawaan, DeepSeek, Phi, Qwen, dan model lainnya, pemrosesan cerdas batch satu klik untuk gambar, video, audio, dll.
★ 769+0Perubahan bintang dalam 7 hari terakhir - #96
⚡ Server inferensi LLM MLX Swift native untuk Apple Silicon. API yang kompatibel dengan OpenAI, streaming SSD untuk model MoE 100B+, kompresi cache KV TurboQuant, aplikasi MACOS + iOS iPhone.
★ 760+6Perubahan bintang dalam 7 hari terakhir - #97★ 753+4Perubahan bintang dalam 7 hari terakhir
- #98★ 753+0Perubahan bintang dalam 7 hari terakhir
- #99★ 748+2Perubahan bintang dalam 7 hari terakhir
- #100
yolort adalah tumpukan runtime untuk yolov5 pada akselerator khusus seperti tensorrt, libtorch, onnxruntime, tvm, dan ncnn.
★ 730+0Perubahan bintang dalam 7 hari terakhir - #101
Privacy Meter: Pustaka open-source untuk mengaudit privasi data dalam algoritma statistik dan machine learning.
★ 725+0Perubahan bintang dalam 7 hari terakhir - #102
Graph Data Science: lapisan abstraksi dalam Python untuk membangun knowledge graph, terintegrasi dengan pustaka grafik populer – di atas Pandas, NetworkX, RAPIDS, RDFlib, pySHACL, PyVis, morph-kgc, pslpython, pyarrow, dll.
★ 691+2Perubahan bintang dalam 7 hari terakhir - #103★ 688—Perubahan bintang dalam 7 hari terakhir
- #104
Ollama untuk model ML klasik. Kompiler AOT yang mengubah model XGBoost, LightGBM, scikit-learn, CatBoost & ONNX menjadi kode inferensi C99 asli. Satu perintah untuk memuat, satu perintah untuk melayani. 336x lebih cepat daripada inferensi Python.
★ 687+0Perubahan bintang dalam 7 hari terakhir - #105
Mesin inferensi LLM murni Rust + CUDA — tanpa PyTorch, kompatibel dengan OpenAI, melayani Qwen3 hingga Kimi-K2
★ 677+14Perubahan bintang dalam 7 hari terakhir - #106
Latih detektor objek yolov3 canggih dari awal!
★ 677+0Perubahan bintang dalam 7 hari terakhir - #107
Simulator yang akurat, berskala besar, dan dapat diperluas untuk sistem inferensi LLM
★ 673+4Perubahan bintang dalam 7 hari terakhir - #108
Mesin inferensi onnx murni C99 yang ringan dan portabel untuk perangkat tertanam dengan dukungan akselerasi perangkat keras.
★ 652+0Perubahan bintang dalam 7 hari terakhir - #109
Orkestrasi tugas GPU serverless berkinerja tinggi — lapisan penjadwalan di balik wavespeed.ai
★ 632+0Perubahan bintang dalam 7 hari terakhir - #110
Pahami inferensi llama3 langkah demi langkah, pahami konsep inti, kuasai penurunan proses, dan implementasikan kodenya.
★ 630+0Perubahan bintang dalam 7 hari terakhir - #111
Deep Learning Streamer (DL Streamer) Pipeline Framework adalah kerangka kerja analitik media streaming sumber terbuka, berbasis kerangka kerja multimedia GStreamer*, untuk membuat pipeline analitik media yang kompleks untuk Cloud atau Edge.
★ 622+0Perubahan bintang dalam 7 hari terakhir - #112
Konversi model mmdetection ke tensorrt, mendukung fp16, int8, input batch, bentuk dinamis, dll.
★ 596+0Perubahan bintang dalam 7 hari terakhir - #113★ 561—Perubahan bintang dalam 7 hari terakhir
- #114
Pustaka Python untuk deteksi objek kecil YOLO dan segmentasi instans
★ 557+0Perubahan bintang dalam 7 hari terakhir - #115
Run MoE models bigger than your RAM. Frontier-size MoE on a 12 GB phone, CPU only, lossless, on stock llama.cpp
★ 543—Perubahan bintang dalam 7 hari terakhir - #116★ 539+1Perubahan bintang dalam 7 hari terakhir
- #117
Jalankan beban kerja deep learning Anda di Kubernetes dengan lebih mudah dan efisien.
★ 532+1Perubahan bintang dalam 7 hari terakhir - #118
Triton Model Analyzer adalah alat CLI untuk membantu memahami kebutuhan komputasi dan memori dari model Triton Inference Server.
★ 526+0Perubahan bintang dalam 7 hari terakhir - #119
A project that optimizes OWL-ViT for real-time inference with NVIDIA TensorRT.
★ 513+7Perubahan bintang dalam 7 hari terakhir - #120★ 512+0Perubahan bintang dalam 7 hari terakhir