Lompat ke konten utama
buildradar
Sign in
Topik · llm-inference

llm-inference

Repositori open source terpantau bertanda llm-inference, diurutkan berdasarkan bintang.

83 repositori
  • Inferensi LLM terdistribusi. Hubungkan perangkat rumah ke dalam kluster yang kuat untuk mempercepat inferensi LLM. Semakin banyak perangkat, semakin cepat inferensinya.

    3.050+4Perubahan bintang dalam 7 hari terakhir
  • Medusa@FasterDecoding

    Medusa: Framework Sederhana untuk Mempercepat Generasi LLM dengan Multiple Decoding Heads

    2.771+0Perubahan bintang dalam 7 hari terakhir
  • EAGLE@SafeAILab

    Implementasi Resmi dari EAGLE-1 (ICML'24), EAGLE-2 (EMNLP'24), dan EAGLE-3 (NeurIPS'25).

    2.521+7Perubahan bintang dalam 7 hari terakhir
  • nanocoder@Nano-Collective

    Sebuah coding agent terbuka untuk terminal Anda, yang dibangun oleh kolektif komunitas alih-alih perusahaan. Gunakan model Anda sendiri, simpan kode di mesin Anda, dan bebas dari ikatan apa pun.

    2.439+41Perubahan bintang dalam 7 hari terakhir
  • neuron-ai@neuron-core

    Framework Agen untuk ekosistem PHP guna membangun aplikasi berbasis AI yang siap produksi. Menghubungkan komponen (LLM, Tools, DB vektor, memori) ke agen yang berinteraksi dengan data dan UI Anda.

    2.086+21Perubahan bintang dalam 7 hari terakhir
  • aici@microsoft

    AICI: Prompt sebagai program (Wasm)

    2.076+0Perubahan bintang dalam 7 hari terakhir
  • llama2-webui@liltom-eth

    Jalankan Llama 2 apa pun secara lokal dengan antarmuka gradio di GPU atau CPU dari mana saja (Linux/Windows/Mac). Gunakan `llama2-wrapper` sebagai backend llama2 lokal Anda untuk Agen/Aplikasi Generatif.

    1.936-1Perubahan bintang dalam 7 hari terakhir
  • beta9@beam-cloud

    Inferensi GPU serverless yang sangat cepat, sandbox, dan pekerjaan latar belakang

    1.764+4Perubahan bintang dalam 7 hari terakhir
  • react-native-executorch@software-mansion

    Cara deklaratif untuk menjalankan model AI di React Native secara on-device, didukung oleh ExecuTorch.

    1.707+5Perubahan bintang dalam 7 hari terakhir
  • InferenceX@SemiAnalysisAI

    Platform Riset Benchmark Inferensi Berkelanjutan Open Source — Kimi K3 2.8T, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72 & segera hadir™ TPUv6e/v7/Trainium2/3 | Platform riset benchmark inferensi berkelanjutan open-source — Kimi K2.7-Code, MiniMax M3, DeepSeekv4, GLM5 - GB200 NVL72 vs MI355X vs B200 vs GB300 NVL72, segera hadir™ TPUv6e/v7/Trainium2/3

    1.613+33Perubahan bintang dalam 7 hari terakhir
  • xllm@xLLM-AI

    Mesin inferensi performa tinggi untuk model LLM, VLM, DiT, dan REC, yang dioptimalkan untuk berbagai akselerator AI. Dihosting di OpenAtom Foundation.

    1.552+11Perubahan bintang dalam 7 hari terakhir
  • aigrantsindia@aigrantsindia

    Organisasi nirlaba yang memajukan AI di India melalui kredit, hibah, dan sumber daya

    1.461+56Perubahan bintang dalam 7 hari terakhir
  • BrowserAI@sauravpanda

    Jalankan LLM lokal seperti llama, deepseek-distill, kokoro, dan lainnya langsung di dalam browser Anda

    1.449+1Perubahan bintang dalam 7 hari terakhir
  • Daftar perangkat lunak yang memungkinkan pencarian web dengan bantuan AI: https://hf.co/spaces/felladrin/awesome-ai-web-search

    1.426+3Perubahan bintang dalam 7 hari terakhir
  • Atomic-Chat@AtomicBot-ai

    Aplikasi AI lokal dan mesin inferensi untuk agen. Jalankan LLM bobot-terbuka secara lokal — privat, 100% offline di komputer Anda. Bergabunglah dengan Discord kami: https://discord.com/invite/8wGSsvmg4V

    1.413+20Perubahan bintang dalam 7 hari terakhir
  • scaling-book@jax-ml

    Rumah untuk "How To Scale Your Model", buku teks singkat bergaya blog tentang penskalaan LLM pada TPU

    1.396+12Perubahan bintang dalam 7 hari terakhir
  • Kumpulan kurasi alat penetration testing tingkat atas dan utilitas produktivitas di berbagai domain. Bergabunglah dengan kami untuk menjelajahi, berkontribusi, dan meningkatkan perangkat peretasan Anda!

    1.383+1Perubahan bintang dalam 7 hari terakhir
  • LeanCopilot@lean-dojo

    LLM sebagai Copilot untuk Pembuktian Teorema di Lean

    1.318+1Perubahan bintang dalam 7 hari terakhir
  • kvcached@ovg-project

    KV Cache Elastis Tervirtualisasi untuk Berbagi GPU Dinamis dan Lebih Jauh Lagi

    1.275+130Perubahan bintang dalam 7 hari terakhir
  • Qwen3.8-27B pada satu RTX 3090 dengan vLLM: ~1.000 tok/s pada 64 konkuren (GEMM tensor-core int8, status fp16 DeltaNet), ~114 tok/s pengguna tunggal pada sampling default / ~124 greedy (draft MTP, vocab draft output sendiri, lm_head int4 terkalibrasi, verifikasi attention split-KV), konteks 150k-262k; patch, skrip requant, benchmark

    1.197+316Perubahan bintang dalam 7 hari terakhir
  • prompt-poet@character-ai

    Meyederhanakan dan mengefisienkan desain prompt untuk pengembang dan pengguna non-teknis dengan pendekatan low-code.

    1.154+0Perubahan bintang dalam 7 hari terakhir
  • tiny-vllm@jmaczan

    Bangun mesin inferensi LLM berkinerja tinggi Anda sendiri dalam C++ dan CUDA - versi yang lebih kecil dari vLLM.

    1.094+15Perubahan bintang dalam 7 hari terakhir
  • OpenAlpha_Evolve@shyamsaktawat

    OpenAlpha_Evolve adalah kerangka kerja Python sumber terbuka yang terinspirasi oleh penelitian inovatif tentang agen pengkodean otonom seperti AlphaEvolve dari DeepMind.

    1.050+0Perubahan bintang dalam 7 hari terakhir
  • AI-Compass@tingaicompass

    “AI-Compass” akan memandu komunitas dalam menavigasi lautan teknologi AI. Baik Anda pemula maupun pengembang tingkat lanjut, Anda dapat menemukan jalur ke berbagai arah AI di sini. Bertujuan untuk membantu pengembang memahami konsep inti AI, teknologi utama, dan tren terkini secara sistematis, serta menguasai seluruh proses dari teori hingga implementasi melalui praktik.

    933+10Perubahan bintang dalam 7 hari terakhir
  • Daftar hosting hebat yang diurutkan berdasarkan harga paket minimum

    925+3Perubahan bintang dalam 7 hari terakhir
  • Implementasi C++ murni dari beberapa model untuk obrolan waktu nyata di komputer Anda (CPU & GPU)

    924+3Perubahan bintang dalam 7 hari terakhir
  • ZhiLight@zhihu

    Mesin akselerasi inferensi LLM yang sangat dioptimalkan untuk Llama dan variannya.

    908+0Perubahan bintang dalam 7 hari terakhir
  • llm_note@harleyszhang

    Catatan LLM, termasuk inferensi model, struktur model transformer, dan catatan analisis kode kerangka kerja LLM.

    889+1Perubahan bintang dalam 7 hari terakhir
  • Roadmap 10 minggu, 30 menit per hari untuk inferensi dan pengoptimalan penyajian LLM. vLLM, SGLang, kuantisasi, decoding spekulatif, benchmarking.

    881+77Perubahan bintang dalam 7 hari terakhir
  • LLM.swift@eastriverlee

    LLM.swift adalah pustaka yang sederhana dan mudah dibaca yang memungkinkan Anda berinteraksi dengan model bahasa besar secara lokal dengan mudah untuk macOS, iOS, watchOS, tvOS, dan visionOS.

    874+3Perubahan bintang dalam 7 hari terakhir
← Kembali ke topik